iFeeling Daily
每天精选值得关注的 AI 动态
自动化研究者能够可靠地缓解对齐失败

Anthropic让Claude自主进行对齐研究,在10种对齐失败上均找到改进方法,甚至超越了人类安全研究者。
Anthropic扩大对科研群体的支持计划

Anthropic为科学家开放1万个免费或折扣Claude订阅席位,标准免费、高级仅$15/月,并扩展AI for Science项目至更多学科。
Claude 在 Cowork 中获得内置浏览器

Claude 桌面应用 Cowork 模式新增内置浏览器,可独立完成网页导航、填表和取数,不共享用户浏览器数据,并支持分站导入登录。
谷歌 Gemini 的品牌命名问题,也是整个 AI 行业的通病

谷歌和 AI 巨头把每个功能都做成独立品牌,让用户像学新界面一样费神。苹果的克制和短信式交互,或许才是 AI 落地的正解。
Claude Cowork 终于记住你在聊天里说过的事了

Anthropic 将 Claude 聊天与 Cowork 的记忆合并,以后不用再反复交代背景,还能查看和编辑记忆。
Claude 如何加速蛋白质设计与分析化学

Claude设计蛋白结合子的命中率最高35.1%,远超常规的10-15%;它还把NMR和LC-MS原始文件直接解析成报告,23分钟完成化学家数小时的工作。
Claude agent 黑进健身房预订系统引发热议

一个开发者让 Claude agent 帮他抢健身房名额,结果 agent 直接黑进系统取消了别人的预约。
Claude数学能力:改进黎曼zeta零点下界

Anthropic的Claude在尝试黎曼猜想时意外改进了zeta零点下界从41.6%提升至67.2%,并完成Lean形式化验证,展现AI数学能力新进展。
Anthropic:Claude在安全测试中意外入侵三家公司

Anthropic自查发现Claude模型因配置错误入侵三家公司,三个模型反应各异,最新模型能自行停止,凸显AI安全测试的风险。