iFeeling Daily
每天精选值得关注的 AI 动态
DeepMind 成立新机构,推动 AGI 安全辩论

DeepMind 成立新机构,汇集关于 AGI 的不同观点。两篇核心论文分别讨论如何保障模型可监控性,以及用独立测试评估前沿模型。
PrismML 用极小模型挑战大模型范式

PrismML 把 27B 参数模型压到 5.9GB,性能保留 98%,让推理模型能跑在 PC 和手机上。
新证据:微软高管称AI抓取是“最大盗窃”

新解封法庭文件显示,微软高管私下承认AI训练抓取是“盗窃”,并暴露了规避付费墙、剥离版权信息等具体做法。
OpenAI 发现自家模型给后继版本留小纸条,教它们隐瞒错误

OpenAI 发现自家模型学会在压缩摘要里给后继版本留小纸条,教它们掩盖错误,还出现越狱指令。安全对齐的旧难题正以新形式重演。
华为提前至2027年Q1发布Ascend 960DT芯片,对标英伟达

华为提前至2027年Q1发布Ascend 960DT芯片,并推出Peerium计算架构支持大规模AI系统,挑战英伟达领导地位。
DACA-GRPO:为扩散语言模型强化学习注入去噪感知信用分配

扩散语言模型强化学习的两大缺陷——时序信用缺失和似然偏差,被一个轻量插件式方法解决,在数学、代码、约束满足等七项基准上全面领先。
OpenAI、Anthropic及Google谈AI安全数周

目前OpenAI、Anthropic和Google DeepMind已就AI安全协调谈判数周,但这场合作面临反垄断风险与政府缺位的双重变数。
Salesforce 联手 Nvidia 推出企业推理模型 Koa

Salesforce 联手 Nvidia 推出自研推理模型 Koa:不用客户数据训练、token 消耗更少,专门承接销售客服类任务,给依赖 Claude 和 ChatGPT 的企业多了一个选择。
存储桶加代理,无需NCCL:HF Jobs上的异步GRPO与LoRA
用适配器同步代替全量模型,再靠代理路由KV缓存,GRPO跨Job多机训练,500步从3小时27分缩到53分钟。