iFeeling Daily
每天精选值得关注的 AI 动态
Anthropic详解Fable 5网络安全过滤与越狱分级框架

Anthropic为Fable 5部署了一套细粒度网络安全分类器,将双用途行为精确划分为禁止使用、高风险双用途、低风险双用途和良性使用四类。更硬核的是,他们联合Glasswing提出了一个量化AI越狱严重性的CJS框架,从能力增益、广度、武器化难度和可发现性四个维度打分,让AI开发者与监管者有了一套共同的语言来沟通实际风险。
如何跟上 Claude 的进化速度:构建 Agent 的三个关键模式

别再替 Claude 操心了。Anthropic 用实验数据证明:让模型自己用代码编排工具调用,比你在 harness 层硬写逻辑更高效。同一个任务,Sonnet 3.5 还困在第二关,Opus 4.6 已经拿到三个徽章还会总结经验了。信任模型,拆掉无用边界。
Claude Managed Agents 内置记忆功能上线

Anthropic 给 Claude Agent 加了个文件系统级的记忆功能,Agent 终于能跨 session 学习和持续进化了。Rakuten 用这个把第一次错误率砍了 97%,Netflix 再也不用手动更新提示词。设计聪明,权限和审计也很到位。
Axiom Math CEO 谈形式化验证:通往数学 AGI 的唯一路径

Axiom Math 创始人 Carina Hong 刚从 2 亿美元融资中走出来,就放下狠话:靠堆算力做不出数学 AGI,形式化验证才是正路。她的团队 30 人,在 Putnam 数学竞赛上拿了满分,碾压所有人类和 AI。
核心转储流行病学:修复一个18岁的老bug

OpenAI 团队追踪 Rockset 中一个看似不可能的崩溃:函数正常执行完却跳转到空地址。通过构建自动化的核心转储分析管道,他们发现这不是一个 bug,而是分别隐藏了18年的 libunwind 竞争条件和一次硬件错误的两个独立事件。值得所有做底层系统的工程师一读。
Google Cloud用AI Agent打造自主化SDLC安全

Google Cloud安全团队自曝内部方案:用多Agent编排将SDLC安全自动化,称Mantis框架能降token消耗85%以上。
Turla情报收集工具集的又一块拼图:STOCKSTAY后门分析

Google威胁情报组深度分析了Turla的STOCKSTAY后门:伪装成股票软件,模块化架构,使用WebSocket通信和环境密钥防分析。与KAZUAR共享代码,三年间持续攻击乌克兰。每个技术细节都经得起推敲。
OpenAI 研究主管:o1 是最大赌注,预训练没死

OpenAI 研究负责人 Mark Chen 一边做韩式豆腐锅一边讲 AGI、o1 和 Scaling Laws。他明确表示预训练没死,但未来要靠推理时计算。还聊了为何评估体系在崩坏、为何研究者比工程师值钱,以及最终科研可能变成全自动的 Agent 任务。有内味,有干货。
异步推理:Agent时代的基础设施新范式

当下所有AI推理都在等人,但真正的Agent不需要即时响应。Sail Research用异步队列+智能路由,把推理成本打到Haiku的六分之一,GPU闲置的算力也被重新填满。这不是未来的想象,是已经在跑的逻辑。