iFeeling Daily
每天精选值得关注的 AI 动态
政府如何决定OpenAI的前沿模型安全可发布?

美国政府如何批准 OpenAI 和 Anthropic 的前沿 AI 模型上市?TechCrunch 调查发现,整个流程黑箱操作、标准不明,依赖高管与白宫的个人关系。连业内专家都不知道审批标准,公众更无从判断安全性。
Google要求广告标注AI生成内容

Google把AI广告标签强制放进用户控制面板,不再只看政治广告。用商家的诚信机制替代全量扫描,给用户一个判断入口,而不是替你判断。这个做法务实且清醒。
如何阻止Meta的AI用你的Instagram照片
Meta的新AI工具Muse Image直接用你的公开Instagram照片生成图片,默认开启。这里告诉你如何关闭这个开关,以及为什么默认开启会引发隐私危机。
邀请硬问题:Anthropic的公众信任实验

Anthropic 不再只谈技术,而是公开邀请所有人问出关于AI最尖锐的问题,并承诺追踪和公开回应。这背后是一个关键洞察:AI公司的长期竞争力,取决于它能否让公众觉得这技术是可控的、站在自己这边的。
OpenAI 升级生物越狱悬赏计划,奖金翻倍至五万美元

OpenAI 把生物漏洞悬赏升级成持续计划,赏金翻倍到5万美元,专门抓能一次性绕过所有生物安全护栏的通用越狱。这不是找小漏洞,是在测试模型推理能力的底线。搞 AI 安全的,得从修补丁转向设计能自适应的防御框架了。
Google Cloud Run 沙箱公开预览

Cloud Run 沙箱让你在无服务器环境里毫秒级启动安全沙箱来跑AI生成的代码,凭据、网络、文件系统三重隔离,默认拒绝出栈,而且不额外收费。它原生集成ADK和ComputeSDK,一行代码就能让AI代理执行动态脚本。对构建AI应用的人来说,这简化了安全执行的最难环节。
本·伯南克加入Anthropic长期利益信托

Anthropic请来前美联储主席伯南克加入独立信托,用宏观经济危机管理经验来制衡AI发展风险。这种治理创新把AI的风险管理从工程师代码审查提升到了美联储级别的宏观审慎监管,值得所有关注AI长期发展的公司参考。
Claude 反思功能:帮你审视与 AI 协作的模式

Anthropic 在 Claude 里加了一个让人自救的反思功能:帮你可视化过去几个月怎么用 AI、有没有把时间花在刀刃上,还鼓励你定期问自己“这件事我真要交给 AI 做吗”。不是教你更高效地干活,而是帮你守住思考的主动权。
AI模型的双用途知识开关

Anthropic与AE Studio提出GRAM方法,通过在Transformer每层添加专用模块,将双用途知识隔离存储,训练一个模型即可实现多种能力开关,初步测试效果堪比数据过滤,且不降低通用性能。