iFeeling Daily
每天精选值得关注的 AI 动态
混合模型比Transformer强在哪?逐token对比揭晓答案

语言模型的评测只看平均loss会掩盖关键能力差异。研究者发现混合模型在实义词和追踪上下文上远超Transformer,但在抄写重复内容时优势消失。这篇用逐token对比揭示了架构的深层优劣。
NeMo AutoModel:一行代码让 MoE 微调提速 3.7 倍

微调 MoE 大模型最头疼的就是显存不够、通信太慢。NVIDIA NeMo AutoModel 只改一行 import,就在 Transformers v5 基础上叠加了 DeepEP 通信计算重叠和 Expert Parallelism 显存分片,把 550B 模型训练吞吐提升了 3.7 倍,还省了 32% 显存,存的 checkpoint 标准兼容 vLLM。这是一篇用工程手段解决核心瓶颈的硬核实战复盘。
FFASR基准测试:在真实世界中评估远场语音识别
首个开放远场ASR基准测试上线,量化了模型在真实房间声学环境下的性能骤降,揭示近场与远场WER的差距可达数倍。
Cisco SD-WAN Manager零日漏洞攻击实例分析

这是一份来自Mandiant的真实攻防战报,详细拆解了APT组织如何利用零日漏洞攻入Cisco SD-WAN集中控制器。从窃取证书建立非法对等连接,到上传CSV文件提权获得root权限,再到反取证清理所有日志,完整的攻击链和具体的payload代码都写得清清楚楚。
OpenAI 联合博通发布 LLM 专用推理芯片 Jalapeño

OpenAI 联合 Broadcom 为其旗舰模型量身打造的专用推理芯片 Jalapeño 发布,实现了远超现有方案的能效比,并用9个月刷新了芯片开发记录。这不是又一个AI芯片新闻,而是软硬一体全栈整合的终极案例。
OpenAI联手Linux基金会,补AI安全的底层信任层

AI安全的真正瓶颈不是技术不行,而是没人敢信谁的话。OpenAI联手Linux基金会成立Appia,目标是把国际标准翻译成一套开源技术规范,让产业链上下游能对同一套检查标准互认结果,补齐AI治理中缺失的信任层。
创投圈最安静角落并不安静

当所有人说 Crypto 已死时,稳定币却在闷声成为全球 Top 10 美债持有者。这篇文章点出一个被忽视的结构性变化:Crypto 正从投机叙事转向真实交易清算基础设施,而 Allium 这种数据基建公司才是最大受益者。
AI时代的可验证信任:机密计算最新进展

Google Cloud放了个大招:把机密计算和旗舰GPU深度绑定,让敏感数据从CPU到GPU全程加密运行。最硬核的是Prompt Encryption SDK开源,用户和模型之间建立了端到端加密通道。这意味着金融、医疗行业可以放心在云端跑AI推理和微调,不用再担心数据泄露了。
Cross-Origin Storage API 在 Transformers.js 中的试验
浏览器跨域缓存隔离让同一份模型权重在不同网站间反复下载,多花 177 MB。交叉存储 API 用 SHA-256 哈希代替 URL 做缓存标识,从根源上解决浪费。Transformers.