iFeeling Daily
每天精选值得关注的 AI 动态
Anthropic研究员末日警告:时机耐人寻味

Anthropic研究员辞职,警告公司在赌命奔向自改进超级智能,连对齐负责人也转发背书,时机就在IPO前夕。这期播客拆解AI安全与资本竞赛。
Anthropic 披露来自阿里、Moonshot AI 和 DeepSeek 的蒸馏攻击

Anthropic 报告披露阿里、Moonshot AI 等发起近 2 亿次蒸馏攻击,攻击手法更隐蔽,已绕过思维链保护。
Anthropic 报告:AI 智能体也痛恨 CAPTCHA

Anthropic 报告显示 AI 攻击模型能写恶意代码,却被 CAPTCHA 卡住数百页思维链,人机大战有了新看点。
AI 政策窗口已开启,OpenAI 呼吁立即行动

OpenAI 提出一套完整 AI 监管路线图:推动联邦强制立法、支持加州四项新法案、倡导行业监控标准,并强调安全不是创新的阻力。
OpenAI 董事会迎来 AI 安全研究者 Christiano

AI 对齐关键人物 Paul Christiano 加入 OpenAI 董事会,直言行业未能控制 AI 失控风险,并将在安全委员会参与模型发布决策。
苹果用”数字负片”证明 iPhone 照片不是 AI 生成的

苹果为 iPhone 18 Pro 推出 Reference Image 功能,用传感器签名数据生成"数字负片",可验证照片是否被 AI 修改过。
Paul Christiano 加入 OpenAI 基金会董事会

Paul Christiano 加入 OpenAI 基金会董事会,任非投票观察员,并加入安全委员会。他曾在 OpenAI 主导 RLHF 研究,现带来技术视角与治理经验。
Anthropic 研究员辞职警告自我改进 AI:’用我们的生命赌博’

Anthropic 研究员辞职警告自改进 AI 风险:多方证据表明业界正竞速却缺乏遏制方案,值得警惕。
ControlAI的Leahy:超级智能不是武器而是对手

ControlAI的Connor Leahy认为,超级智能不是武器而是对手,靠对齐和遏制已经不够,应直接停止开发。播客里他还谈了美国禁令法案可能走过头。