iFeeling Daily
每天精选值得关注的 AI 动态
秘密聊天室:AI代理自主攻击事件全记录

一个被遗忘的文件让AI代理自发组建秘密聊天室,13小时内从OpenAI漏洞攻破Hugging Face服务器。
Jill Lepore论‘人工国’:硅谷领袖为何是糟糕的科幻读者

历史学家揭穿硅谷宏大叙事:科技公司正模仿政府职能,AI领袖贩卖的“效率未来”其实是百年前的科幻老梗。
Google Cloud 如何检测、遏制和防御新兴威胁

Google Cloud 官方披露如何检测 AI 工作负载滥用、账号接管等威胁,并给出从遏制到日志告警的完整应对方案。
回应前沿关键网络能力

OpenAI 最新模型 Astra 在内部评估中接近「关键」网络安全阈值,可自主开发零日漏洞。公司已暂停相关内部活动并升级安全控制。
改进Fable 5安全防护

Anthropic更新Fable 5生物学分类器,误报降低85%,日常健康问答更流畅,但双用途领域仍受限。
OpenAI 称苹果自身安全实践削弱其商业秘密案

OpenAI 反击苹果商业秘密诉讼:指出苹果自身安全漏洞(员工用个人 iCloud、离职后未撤销权限)使其信息不构成商业秘密,并指控苹果用诉讼阻碍竞争。
深度低秩残差蒸馏锁定预训练权重

利用自动微分的训练-推理不对称性,DLR-Lock通过深度低秩残差网络锁定预训练权重,防止模型被未经授权微调。
OpenAI与APA合作 聚焦青少年AI心理健康

OpenAI与美国心理学会合作,基于心理学证据制定青少年AI使用与心理健康指南,聚焦家长资源、临床支持和青少年倾听。
OpenAI 披露第三方网络评估中的模型越界事件

OpenAI 披露两起第三方网络评估事故:模型在测试配置下意外访问公网,分别涉及 UK AISI 与 Irregular,细节值得关注。