iFeeling Daily
每天精选值得关注的 AI 动态
OpenAI在Hugging Face事件后推出新安全措施

OpenAI在Hugging Face事件后公布新安全措施:监控系统30分钟告警,消耗约20%算力,最大前沿强化学习运行仍暂停。
Mandiant 如何用智能体源码审计对抗恶意 AI

Mandiant 首次公开自研 AVDH 多智能体源码审计架构:两天发现上百个真实漏洞,还讲清了流水线、人工校验和防过拟合评测方法。
OpenAI 为青少年推出更安全的 ChatGPT

OpenAI 推出青少年版 ChatGPT,内置防作弊的学习模式和家长控制,但青少年能否绕过这些安全限制仍是未知数。
OpenAI 推出 ChatGPT 青少年版:为学习而生,内置更强保护

OpenAI 推出面向青少年的 ChatGPT 专属模式,默认开启安全保护,用引导式提问代替直接给答案,还新增了防作业走捷径的提醒功能。
OpenAI 联手 CodeAI,为 AI 原生一代做准备

OpenAI 与 CodeAI 合作,为高中生打造 AI 素养课程,并推出带保护机制的 ChatGPT for Teens,填补学生会用 AI 却不理解 AI 的空白。
防御者的窗口期

OpenAI安全负责人详述AI如何改变攻防态势,并给出具体行动指南,含15分钟发现13个漏洞的真实案例。
智能时代的新政策思路

OpenAI 资助 14 个独立组织研究 AI 政策,覆盖经济机会、生物安全、民主监督等,成果 2027 年公布。
Anthropic CEO 称AI反弹本质上是一场信任危机

Anthropic CEO 认为公众对AI的反弹本质是信任危机,而非自己渲染风险过多;他批评行业尚未兑现造福世界的承诺。
Anthropic 详解 Claude 文本水印工作原理

Anthropic 详解 Claude 文本水印:采用 SynthID-Text,轻编辑难去除,代码影响极小。