iFeeling Daily
每天精选值得关注的 AI 动态
AI模型的双用途知识开关

Anthropic与AE Studio提出GRAM方法,通过在Transformer每层添加专用模块,将双用途知识隔离存储,训练一个模型即可实现多种能力开关,初步测试效果堪比数据过滤,且不降低通用性能。
Google SynthID系统成功揭穿McConnell AI假图

一张Mitch McConnell的AI假图被SynthID水印秒破,证明了嵌入像素层的不可见水印在跨平台传播后依然有效。但问题在于:只有Google和OpenAI参与,其他厂商不加入就是漏洞。
辨别编码评估中的信号与噪音

OpenAI 深度审计发现 SWE-Bench Pro 约 30% 的任务是 broken 的,测试设计缺陷导致模型能力被严重高估。他们用自动流水线 + 人工复核揪出四类典型问题,并建议不再盲信该基准。评估信号的真伪,比数字本身重要得多。
这家初创公司认为机器人将迎来ChatGPT时刻

别被主流机器人公司忽悠了,或许机器人基础模型的关键不是海量真实数据,而是游戏数据。General Intuition只用8分钟真实数据微调就让四足机器人零样本避障,这思路可能彻底改变机器人开发流程。
SpaceXAI 发布 Grok 4.5,马斯克称其为 Opus 级模型

Grok 4.5 对标 Opus 但把输出 token 价格直接打到 6 美金,号称两倍 Token 效率。如果实测过关,意味着以后做复杂任务不用再纠结成本了——同样的活儿,花更少的钱。
GPT-Live 发布:让语音对话更像真人聊天

语音AI至今听着像机器,核心不是它不够聪明,而是必须等你把话说完才能回应。OpenAI的GPT-Live用全双工架构+解耦设计,首次让AI实现人类的对话节奏——能同时听和说、适时插话、甚至在你思考时安静等待。这才是语音交互的真正门槛。
帮K-12教师建立实用AI技能

OpenAI用一场覆盖8个城市的线下工作坊,让K-12教师不用啃技术文档、不整高大上概念,直接靠改教案、写通知这些日常场景上手AI。核心数据很硬:每周用AI的老师平均省出5.9小时,相当于整个暑假。对做教育产品的人来说,这暴露了AI落地的真正瓶颈不是功能,而是场景嵌入和信任建设。
谷歌精选33家网络安全初创公司,聚焦AI Agent安全

网络安全正面临从防人到防AI Agent的范式转移。本文介绍了33家专注AI Agent安全、应用安全和云基础设施安全等领域的初创公司。其中最具启发性的是:安全不再等于给AI加壳,而是要监控Agent的每一个动作,甚至让AI学会自己给自己打补丁。干货密集,值得细读。
开源AI崛起为何尚未伤害Anthropic?

前沿模型和开源不是零和博弈,而是探索与生产的分工:前者负责用高价验证新用例,后者继承成熟场景靠规模盈利。Anthropic的支出占比不降反升,说明高端需求仍在高速增长。这篇文章用生命周期框架解释了当前AI模型市场最反直觉的现象。