iFeeling Daily
每天精选值得关注的 AI 动态
Sequoia 加注 Cymphony:AI 代理催生企业安全新风险

Sequoia 领投 2500 万美元押注 Cymphony,这家初创公司用“工作力图谱”解决 AI 代理带来的企业安全漏洞,已发现单客户 8.5 万个文件暴露。
黑客窃取 Claude 令牌,订阅用户 token 被盗

黑客通过窃取会话密钥盗用 Claude 账户 token,受害者在无操作时用量狂涨,Anthropic 只退款不提供明细,用户无奈转投 Cursor。
数学家指控 OpenAI 抢先证明千禧年难题

数学家指控 OpenAI 得知其研究进展后,用大量算力抢先证明同一数学难题,还要求删掉合作者署名。
OpenAI 设 500 万美元基金资助青少年 AI 发展研究

OpenAI 拿出 500 万美元资助生成式 AI 与青少年发展研究,单项目最高 100 万,申请到 2026 年 10 月。聚焦情绪、社交、安全设计,适合研究者或关心 AI 教育的人。
为谁而安全?拒绝主题的正确子集,而非整个主题

安全调优不能只盯有害拒绝率:同一模型过拒绝能从2%飙到74%。论文用边界感知自蒸馏,将合规侧过拒绝从32.94%压到4.16%,同时保留有害侧拒绝。
GTIG 报告:对抗性 AI 从提示词攻击走向自主化

GTIG 报告显示,攻击者已从提示词滥用转向 agentic AI:有人用 AI 在六小时内完成云入侵到大规模凭证收割,供应链投毒手法也全面升级。
Opaque recurrence, and other AI terms that you should probably know | TechCrunch

OpenAI 新模型 Astra 的“不透明循环”推理技术引发安全争议:效率更高但更难监控,这可能是 AI 可解释性倒退的第一步。
作者反击:出版商与代理人争抢Anthropic和解金份额

出版商和代理人在1.5亿美元AI版权和解金分配中“抢蛋糕”,作者反击并揭露记录混乱的系统性问题。
异类心智:AI对齐、监控与谨慎推进的紧迫性

OpenAI 首席科学家指出,AI对齐与思维链监控的有效性正衰减,必须谨慎推进缩放,同时加速构建防御系统并协调放缓。