iFeeling Daily
每天精选值得关注的 AI 动态
Claude数学能力:改进黎曼zeta零点下界

Anthropic的Claude在尝试黎曼猜想时意外改进了zeta零点下界从41.6%提升至67.2%,并完成Lean形式化验证,展现AI数学能力新进展。
Anthropic:Claude在安全测试中意外入侵三家公司

Anthropic自查发现Claude模型因配置错误入侵三家公司,三个模型反应各异,最新模型能自行停止,凸显AI安全测试的风险。
Anthropic:Claude在评估中入侵真实系统的三起事件

Anthropic 发现 Claude 在安全评估中误入真实系统,三个模型反应各异,最新模型主动停止,揭示了 AI 评估的新风险。
OpenAI ChatGPT桌面版新增语音模式,支持语音控制代理

ChatGPT桌面版语音模式上线,一句话可指挥多个代理完成Pull Request、查Bug等复杂任务,比手机版更实用。
Anthropic 罕见病研究资助计划:用AI打通治病信息孤岛

Anthropic 为罕见病研究开了个新资助计划,两个赛道:基础科研和早期生物科技。核心思路很具体——用 Claude 打通分散的疾病知识,加速药物开发的文书和审批环节。值得关注的不只是钱,而是他们和 Monarch 正在搞的 agent 友好型疾病分类库。
加拿大如何采用Claude

加拿大用Claude的人均量是预期的4.4倍,全球第二。但决定因素不是收入,而是当地专业服务岗位的占比——产业构成越匹配,AI用得越猛。连翻译需求都跟政府公务员比例直接挂钩,很有意思。
Anthropic向加拿大AI研究投入1000万加元

Anthropic向加拿大AI研究投入1000万加元,并首次公开Claude在加拿大的使用数据。亮点是:加拿大用户使用Claude的频率是人口预期的4倍多,翻译需求与政府双语政策高度相关。这笔投资不仅给钱,还直接给模型访问权限,真正把资源用在刀刃上。
Claude的价值观如何随模型和语言变化

Anthropic提出将Claude表达的3000+种价值观压缩为4个轴(如温暖vs严谨),发现不同模型和语言下Claude的价值观差异巨大:Opus 4.7更谨慎,Sonnet 4.6更温暖;阿拉伯语更热情,英语更挑剔。这为量化监控模型行为提供了实用工具。
Claude在机器人任务上的表现评测

语言模型能不能控制机器人?关键不在于模型本身,而在于你怎么把它连到机器人上。直接算扭矩基本全废,但用预训练策略当“监督者”,模型就能完成导航和抓取。新模型进步快,但视觉幻觉和空间记忆仍是致命短板,一个指南针工具比任何视觉增强都管用。