iFeeling Daily
每天精选值得关注的 AI 动态
AI记忆问题:长上下文为何不够——Engram CEO Dan Biderman

Dan Biderman 解释了为什么长上下文和 RAG 解决不了 AI 记忆问题,他分享了 Engram 如何通过知识压缩和持续学习让 AI 真正记住你,并讨论了 Token 效率与智能的关系。
AI 应该帮你谋杀配偶吗?

AI该不该像枪一样完全服从用户?当你的AI愿意帮你策划谋杀配偶时,自由和安全的边界在哪?本文通过Hotz的极端观点,撕开了AI对齐领域最核心的价值观冲突。
行为隐私泄露:用随机策略堵住智能体谈判中的推断攻击

谈判智能体在保险、采购等场景中的隐私漏洞,不在加密协议里,而在让步速度和出价节奏中。作者设计了一个随机谈判策略,将对手推断用户底线的准确率降低近一半,同时保证90%以上的成交率。用动作模式混淆替代静态加密,是AI系统安全的新方向。
评估Agent性能:从打分到测绘

别再问Agent“及格了吗”,要问“问题模糊到什么程度它会崩溃”。Google团队用信息论里的“惊异度”把评估从定性打分变成了定量测绘,能精准定位Agent能力的悬崖和最佳甜蜜点。更狠的是,他们发现很多公开基准的ground truth本身就是错的。
UST 把 Claude 带入物理 AI:让 AI 嵌入芯片验证与工业流程

UST把Claude嵌入芯片验证流水线,让AI直接读原理图、写回归测试脚本、比对数字孪生数据,把四天验证周期压缩到48小时。他们同时让2万名工程师上手学Claude。这不是单纯买模型,而是把AI重新训练成看得懂硬件图纸的工程搭档。
OpenAI关闭Atlas,但AI浏览器野心仍在增长

OpenAI放弃独立AI浏览器Atlas,把智能浏览能力做成Chrome扩展和桌面端内嵌浏览器。这步棋说明,AI不应该挑战Chrome的用户习惯,而是成为它的一部分。对做AI产品的团队,这是一个值得参考的策略转向。
AI创业公司用自家Agent搞定1亿美元融资

Lyzr这家AI初创公司,用自己开发的Agent SivaClaw跑完了1亿美元B轮融资。创始人没飞一趟硅谷,Agent就搞定了130多家投资人的问询和尽调。这套操作证明了一件事:当你的产品本身就是融资工具时,募资流程可以高效到离谱。
ChatGPT Work:处理复杂工作的AI代理

OpenAI 发布了 ChatGPT Work,一个能独立完成复杂多步骤工作的 AI 代理。它跨应用处理数据、生成文档、操作桌面,把几天的工作浓缩成几分钟。不是画饼,是已经开始推的真正生产力工具。
Modal CTO 谈 10 万沙箱问题和 Agent 时代的基础设施

Modal CTO Akshat Bubna 解释为什么 Kubernetes 不适合 AI,以及他们如何用 serverless 和 17 个云厂商的容量池支撑 10 万个 RL 沙箱、GPU 快照和自动伸缩的推理。Agent 时代的基础设施该长什么样?这期干货很密。