iFeeling Daily
每天精选值得关注的 AI 动态
GPT-5.6发布:用更少的token做更多的事

GPT-5.6不再单纯追求更强的模型,而是重新定义更强的含义——单位token的产出效率。旗舰Sol用四分之一成本击败Claude Fable 5,入门Luna用十六分之一成本达到相近效果。这才是让AI真正能从演示走向干活的关键一步。
用强化学习逼视频模型学会“先来后到”

多模态模型看不懂视频时间线?这篇论文用了一个巧妙的强化学习技巧:让模型对比正常顺序和打乱顺序的视频,然后奖励那些能正确推理出因果关系的答案。效果出奇地好,而且无需昂贵的标注数据。
AI模型的双用途知识开关

Anthropic与AE Studio提出GRAM方法,通过在Transformer每层添加专用模块,将双用途知识隔离存储,训练一个模型即可实现多种能力开关,初步测试效果堪比数据过滤,且不降低通用性能。
这家初创公司认为机器人将迎来ChatGPT时刻

别被主流机器人公司忽悠了,或许机器人基础模型的关键不是海量真实数据,而是游戏数据。General Intuition只用8分钟真实数据微调就让四足机器人零样本避障,这思路可能彻底改变机器人开发流程。
SpaceXAI 发布 Grok 4.5,马斯克称其为 Opus 级模型

Grok 4.5 对标 Opus 但把输出 token 价格直接打到 6 美金,号称两倍 Token 效率。如果实测过关,意味着以后做复杂任务不用再纠结成本了——同样的活儿,花更少的钱。
Google Photos上线AI视频重混功能

Google Photos的Video Remix用AI一键给视频换背景、加滤镜、调光影,连水彩素描效果都能直接出片。背后是Gemini Omni模型,操作简单到离谱,但只给订阅用户用。值得关注的不是功能本身,而是Google怎么用AI把专业编辑变成了消费行为,顺便绑定生态。
OpenAI 发布新语音模型,让实时对话更自然

OpenAI 发了两个能同时听和说的原生语音模型,终于不用被语音助手礼貌地打断了。亮点是它学会了“沉默”,能长时间只听不说,等被叫到再回应。真正值得关注的不是聊天变顺了,而是他们想把语音做成操控复杂 AI Agent 的默认界面。
为什么CEO认为游戏数据比互联网更适合训练AI

大语言模型缺的是物理直觉。这家贝佐斯投的2.3亿美元公司,赌游戏数据比互联网文本更能训练AI理解空间和运动,因为游戏本质是精确的物理模拟器。
智能体的数据问题

Agent做不好,不是模型不行,是数据没覆盖失败路径。NVIDIA这篇讲透为什么合成数据是唯一在不泄露公司秘密的前提下,让Agent学会处理真实世界意外的办法。还有Prompt Atlas可视化工具,让你直观理解数据分布。