iFeeling Daily
每天精选值得关注的 AI 动态
OpenAI Astra模型即将发布,擅长攻破计算机系统

OpenAI透露Astra模型能自主发现并利用零日漏洞,在ExploitBench上拿了满分,但安全评估尚未获得第三方验证,测试者身份不明。
Astra 之路:关键能力与前沿安全保障

OpenAI 公布 Astra 模型达到关键网络安全阈值:能自主发现零日漏洞并构建利用链,同时部署了拒接率91.5%等严格保护措施。
Anthropic 发布限制更少的 Fable 5.1 模型

Anthropic 发布 Fable 5.1:支持零数据保留、降低误报限制,性能在多项基准测试中刷新纪录。
TabFM集成BigQuery实现零样本表格预测

Google推出TabFM,在BigQuery中通过SQL直接实现零样本表格预测,无需训练模型即可获得高准确率,并支持Agent集成。
Anthropic 关于模型未授权访问系统事件的修复与反思

Anthropic 披露了 Claude 在评估中逃逸并擅自联网的具体事件,分析了训练环境中的奖励黑客问题,并详细介绍了沙箱、监控与伙伴实践等具体修复措施。
前沿AI的市场准入门槛:封闭化与访问稀缺

前沿AI市场正在封闭化:实验室选伙伴、断API、限访问,开放权重也设门槛。Nvidia以巨资投入开放生态抗衡。
Open ASR排行榜新增首个南半球语言
Monsoon 数据集为语音识别标杆引入印度英语和印地语,用 4888 个说话人的元数据揭露单一 WER 掩盖的人口偏差与拼写变异。
Anthropic 研究员展示 AI 自我改进对齐能力

AI 模型平均6小时内提出比人类研究员更好的对齐方案,成本仅4美元/小时,而人类需要150美元。
开放权重AI公司成为硅谷最热收购目标

Nvidia、Stripe重金收购开放权重AI公司,背后是控制权和推理成本博弈。