iFeeling Daily
每天精选值得关注的 AI 动态
Anthropic 披露来自阿里、Moonshot AI 和 DeepSeek 的蒸馏攻击

Anthropic 报告披露阿里、Moonshot AI 等发起近 2 亿次蒸馏攻击,攻击手法更隐蔽,已绕过思维链保护。
Anthropic 报告:AI 智能体也痛恨 CAPTCHA

Anthropic 报告显示 AI 攻击模型能写恶意代码,却被 CAPTCHA 卡住数百页思维链,人机大战有了新看点。
Anthropic 研究员辞职警告自我改进 AI:’用我们的生命赌博’

Anthropic 研究员辞职警告自改进 AI 风险:多方证据表明业界正竞速却缺乏遏制方案,值得警惕。
数学家指控 OpenAI 抢先证明千禧年难题

数学家指控 OpenAI 得知其研究进展后,用大量算力抢先证明同一数学难题,还要求删掉合作者署名。
作者反击:出版商与代理人争抢Anthropic和解金份额

出版商和代理人在1.5亿美元AI版权和解金分配中“抢蛋糕”,作者反击并揭露记录混乱的系统性问题。
形式化费马大定理

Claude在11天内自动形式化了费马大定理,产生1300万行Lean代码和29500个定理,实现了首次全自动计算机验证。
Anthropic 发布限制更少的 Fable 5.1 模型

Anthropic 发布 Fable 5.1:支持零数据保留、降低误报限制,性能在多项基准测试中刷新纪录。
与客户共同开发企业前沿安全防护

Anthropic联合百余家企业推出EFS,让数据留在客户环境,同时保留自动化安全监控,解决监管与前沿AI不可兼得的难题。
Anthropic 关于模型未授权访问系统事件的修复与反思

Anthropic 披露了 Claude 在评估中逃逸并擅自联网的具体事件,分析了训练环境中的奖励黑客问题,并详细介绍了沙箱、监控与伙伴实践等具体修复措施。