iFeeling Daily
每天精选值得关注的 AI 动态
NeMo AutoModel:一行代码让 MoE 微调提速 3.7 倍

微调 MoE 大模型最头疼的就是显存不够、通信太慢。NVIDIA NeMo AutoModel 只改一行 import,就在 Transformers v5 基础上叠加了 DeepEP 通信计算重叠和 Expert Parallelism 显存分片,把 550B 模型训练吞吐提升了 3.7 倍,还省了 32% 显存,存的 checkpoint 标准兼容 vLLM。这是一篇用工程手段解决核心瓶颈的硬核实战复盘。
Databricks 联合创始人谈 Agent 云、Omnigent 和数据库的未来

Databricks 两位联合创始人深入聊了他们为什么要开源 Omnigent 来统一 agent 框架,以及 LTAP 如何绕过 HTAP 的工程陷阱。对于做 agent 或数据工程的人来说,全是非共识的架构决策和内部经验。
FFASR基准测试:在真实世界中评估远场语音识别
首个开放远场ASR基准测试上线,量化了模型在真实房间声学环境下的性能骤降,揭示近场与远场WER的差距可达数倍。
Cisco SD-WAN Manager零日漏洞攻击实例分析

这是一份来自Mandiant的真实攻防战报,详细拆解了APT组织如何利用零日漏洞攻入Cisco SD-WAN集中控制器。从窃取证书建立非法对等连接,到上传CSV文件提权获得root权限,再到反取证清理所有日志,完整的攻击链和具体的payload代码都写得清清楚楚。
OpenAI 联合博通发布 LLM 专用推理芯片 Jalapeño

OpenAI 联合 Broadcom 为其旗舰模型量身打造的专用推理芯片 Jalapeño 发布,实现了远超现有方案的能效比,并用9个月刷新了芯片开发记录。这不是又一个AI芯片新闻,而是软硬一体全栈整合的终极案例。
GPT-5 Pro 如何破解免疫学家三年未解之谜

免疫学家Unutmaz用一个困扰实验室三年、传统方法无法解释的T细胞分化谜题,验证了GPT-5 Pro的推理能力。AI不仅指出关键蛋白IL-2的作用,还正确预测了未发表的实验结果。这不再是信息检索,而是真正的科学协作。
用本地模型免费实时分类开源仓库的Issue和PR
作者手拿128GB内存的NVIDIA GB10,硬是用gemma和qwen跑出了一套能实时过滤开源项目几百个Issue/PR的本地分类系统。核心思路是半智能体架构:分类走LLM推理,告警走确定性规则,再用vLLM的NVFP4量化把吞吐拉到每秒400+ token。一条7.
用AI实现每周发布:一个可复制的开源工作流
Hugging Face 把发布周期从 6 周缩短到每周,靠的不是纯AI自动化,而是一个聪明的“AI起草 + 代码校验 + 人工定稿”流水线。关键是那个确定性校验环节,确保模型生成的内容没遗漏、没虚构。整套方案只用开源工具,每次成本才两毛五。
AI Agent 安全新漏洞与灰天鹅事件预警

Gray Swan 两位联合创始人详解为什么 AI Agent 的安全和传统网络安全完全不同。他们展示了自己训练的 AI 系统已经能比人类更高效地破解 GPT-4 和 Claude,并提出“致命三要素”来判断你的 Agent 是否已经敞开了数据大门。