iFeeling Daily
每天精选值得关注的 AI 动态
LenVM:token级长度建模的可扩展价值预训练

生成式模型的输出长度很难精确控制,但LenVM通过在每个解码步预测剩余长度,实现了超细粒度的长度管理。在LIFEBench上,7B模型长度分数直接从30.9飙到64.8,超过GPT-4。关键是,它不需要额外标注,训练信号天然密集。想控制推理成本又不想牺牲性能?这个思路值得关注。
RayRoPE:让多视角Transformer真正理解3D几何的位置编码方案

多视角Transformer的核心痛点:传统编码要么认像素坐标,要么认光线方向,但都丢了真实3D几何关系。RayRoPE用一个巧妙思路——把预测的3D点投影到查询帧做编码,再算不确定性,结果LPIPS直接提了15%,结构很优雅,实用性极强。
非营利组织Current AI正竞相为所有人构建AI的万维网

当主流AI只服务英语世界时,一个非营利组织联合多国政府与基金会,用开源、离线、本地化的方式,为印度22种语言打造了口袋AI设备。它证明:公共AI基础设施可以像万维网一样免费开放,而且数据主权必须回归社区,而不是硅谷。
Neil Rimer:AI 财富必将重新分配

Neil Rimer,Index Ventures联合创始人,罕见地讲出了一个科技圈不愿面对的真相:AI制造的$2.9万亿美元新财富必然面临重新分配,要么主动,要么被强迫。从Giving Pledge大幅降温到加州酝酿5%亿万亿万富翁税,他敏锐地指出行业正站在卡内基式慈善与罗斯福式税收的历史十字路口。读完后你可能会重新思考AI行业的财富游戏规则。
Hugging Face 遭遇全局 AI Agent 入侵:我们的防守突破与新不对称
Hugging Face 遭遇了一次由自主AI Agent全程驱动的入侵。防守方用LLM分析Agent在几小时内处理了17000条攻击日志,但商用模型的护栏却把取证数据当攻击给屏蔽了——这件事直接暴露了AI安全领域一个尚未被充分讨论的致命不对称。
AlloyDB AI函数突破索引限制

当数据库遇到中文分词难题,传统方案又慢又复杂。AlloyDB直接把Gemini AI集成到SQL里,不用搬数据就能实现智能分词和混合搜索。这篇教程手把手教你用存储过程批量处理,比外部管道快得多。
模型路由:看似简单,实则复杂

模型路由不是给任务选最佳模型,而是优化整个系统。实际成本受缓存影响巨大,难度往往事后才知道,延迟看基础设施。一个轻量级优化算法能在成本、精度、延迟间做灵活权衡,比基于难度的路由好用得多。
Claude在机器人任务上的表现评测

语言模型能不能控制机器人?关键不在于模型本身,而在于你怎么把它连到机器人上。直接算扭矩基本全废,但用预训练策略当“监督者”,模型就能完成导航和抓取。新模型进步快,但视觉幻觉和空间记忆仍是致命短板,一个指南针工具比任何视觉增强都管用。
行为隐私泄露:用随机策略堵住智能体谈判中的推断攻击

谈判智能体在保险、采购等场景中的隐私漏洞,不在加密协议里,而在让步速度和出价节奏中。作者设计了一个随机谈判策略,将对手推断用户底线的准确率降低近一半,同时保证90%以上的成交率。用动作模式混淆替代静态加密,是AI系统安全的新方向。