iFeeling Daily
每天精选值得关注的 AI 动态
Claude Opus 4.8 发布:更诚实、更可控的 AI 合作伙伴

Opus 4.8 的核心进步不是跑分更高,而是开始学会说“我不确定”。它会在代码有漏洞时主动指出、方案不靠谱时反驳,这对企业级 Agent 的信任建立是质变。配合动态工作流和努力控制机制,大模型终于开始像一个严谨的同事,而不是那个永远自信满满却总留坑的新人。
物理学的最大未解之谜:反物质、暗能量与万物理论

Fermilab 物理学家 Don Lincoln 细聊反物质消失、暗能量本质和万物理论的现状。他指出宇宙中 95% 是未知物质,当前理论物理面临量子力学与相对论无法统一的根本困境,实验才是检验一切的最终标准。
开放模型生态的崛起:69%市场份额背后的竞争逻辑

OpenRouter 的真实数据显示,开放权重模型已占据 API 前沿市场 69.1% 的流量,封闭模型被压缩到三成。这个数字戳破了一个神话:开发者不是嘴上喊着要用开源,实际上身体却很诚实——生产流量正在大规模迁移到开放模型。
Ethan He 谈 xAI 构建 Grok Imagine 与视频生成未来

Ethan He 分享了从 NVIDIA Cosmos 到 xAI 构建 Grok Imagine 的实战经验,揭开视频模型训练、VAE、推理加速等细节,并探讨世界模型与视频 Agent 的未来方向。
开放模型生态的崛起:69%市场份额背后的竞争逻辑

OpenRouter 的真实数据显示,开放权重模型已占据 API 前沿市场 69.1% 的流量,封闭模型被压缩到三成。这个数字戳破了一个神话:开发者不是嘴上喊着要用开源,实际上身体却很诚实——生产流量正在大规模迁移到开放模型。
Trustpilot 如何用 Gemma 构建实时评论数据丰富化架构

Trustpilot 用微调 Gemma 构建了一个日处理百万评论的实时流处理 pipeline。核心思路是把业务逻辑和 LLM 推理解耦成两个独立端点,用 Gemini 做教师模型生成高质量微调数据,最终用 9B 参数的轻量模型跑出了接近大模型的效果和成本可控的推理。
JetBrains 发布 Mellum2:专注低延迟文本代码任务的 12B MoE 模型

JetBrains 开源了一个 12B 的 MoE 模型 Mellum2,总参数 12B 但只激活 2.5B,速度快 2 倍以上,专注文本和代码任务。思路很清晰:不做通用大模型,而是做一个高效、可私有部署的"工具人",专门处理路由、RAG、子代理这类高频但不需要顶级算力的任务。
NVIDIA发布Cosmos 3:首个物理AI全能世界基础模型

NVIDIA发布了Cosmos 3,这是一个将世界生成、物理推理和动作生成整合在单一模型中的omni-model。基于MoT架构,8B的Nano版和32B的Super版都已上线Hugging Face。
为 AI 时代构建的数据中心与全球网络

Google 把“数据中校园”当成“单台计算机”来设计网络:把东西向 GPU 互联、前端存储访问、跨校园 WAN 解耦成三个独立域,每个域独立演进并与新芯片协同设计。