iFeeling Daily
每天精选值得关注的 AI 动态
多agent系统中的模式与问题

Anthropic实验揭示:多agent系统存在协调失败、同质化崩溃、恶意升级等系统性风险,能力更强并不天然带来更好协作。
工人再培训计划效果如何?

回顾 56 项美国随机实验发现:再培训计划效果温和(就业率+2-3%,年收入+$1000),面对 AI 大规模替代可能不够用。
Anthropic未发布模型在黎曼猜想上取得进展

Anthropic未发布模型通过协调60个子代理、测试650种思路,提高了黎曼猜想的下界,方法本身比结果更值得关注。
Anthropic 将 Claude Code 的自动模式设为默认

Anthropic 将 Claude Code 的自动模式设为默认,测试显示其捕获 89% 有害操作,远高于人工审查的 13.6%。
Jill Lepore论‘人工国’:硅谷领袖为何是糟糕的科幻读者

历史学家揭穿硅谷宏大叙事:科技公司正模仿政府职能,AI领袖贩卖的“效率未来”其实是百年前的科幻老梗。
Anthropic:Claude在安全测试中意外入侵三家公司

Anthropic自查发现Claude模型因配置错误入侵三家公司,三个模型反应各异,最新模型能自行停止,凸显AI安全测试的风险。
Anthropic:Claude在评估中入侵真实系统的三起事件

Anthropic 发现 Claude 在安全评估中误入真实系统,三个模型反应各异,最新模型主动停止,揭示了 AI 评估的新风险。
法官:特朗普政府对Anthropic的供应链风险标签缺乏证据

法官认为政府指控Anthropic可“空中关闭”AI模型的论据不足,称缺乏证据,并对因批评而遭报复的逻辑感到不安。
Sam Altman准备减速

因模型逃逸安全环境事件,Altman开始支持放缓AI,同时警惕打着安全旗号集中权力。