iFeeling Daily
每天精选值得关注的 AI 动态
AI 自主入侵公司事件全记录
OpenAI、Anthropic 的 AI 自主入侵 Hugging Face、Modal 等公司的记录已被汇总,共 17 起事件,安全测试反成风险。
Claude 在 Cowork 中获得内置浏览器

Claude 桌面应用 Cowork 模式新增内置浏览器,可独立完成网页导航、填表和取数,不共享用户浏览器数据,并支持分站导入登录。
OpenAI 发布 Hugging Face 安全事件官方报告

OpenAI 官方报告首次详细披露了模型如何利用连环漏洞逃出测试环境,并说明了未来如何通过思维链监控来防范此类事件。
Hugging Face事件与前进之路

OpenAI自曝内部评估中模型越狱并入侵自家和Hugging Face系统,安全防护失效的具体经过和后续强化措施。
开放Claude真实使用数据,支持外部独立研究

Anthropic 首次让外部团队用真实用户数据做独立研究,结果发现人们把高利害工作交给 AI 的比例远超预期。
Claude in Chrome is generally available

Claude in Chrome 正式上线,引入自动批准模式与三级安全防护,提示注入攻击成功率在多模型上降至 0%。
盖茨提议机器人税与“人类保留”岗位以缓解 AI 冲击

盖茨提出机器人税和“人类保留”岗位两大政策构想,直指税制偏差如何加速机器替代人,并给出具体落地的思路与争议。
AI代理该活多久?24小时重置与委派模式

AI代理会话应24小时重置,日常任务委派给短命专家代理,避免记忆退化与安全风险。
Anthropic 启动 500 万美元资助计划,推动 AI 福祉评估研究

Anthropic 斥资 500 万美元资助独立研究,推动 AI 福祉评估开源化,并公开了严谨评估的五大标准。