iFeeling Daily
每天精选值得关注的 AI 动态
AI应用的黄金时代到来

AI应用的黄金时代,拼的不是模型大小,而是如何用有限的预算榨出最多智能。
潜伏一年:针对北美医学和国防研究机构的高级网络间谍行动

Google 揭露了一起针对北美医学和军事机构的长期渗透,黑客利用科研软件 REDCap 的版本兼容漏洞切入,植入能通过软件升级“永生”的恶意软件,最后竟然用企业邮件系统的合规规则来悄悄外传情报。整个过程花了超过一年,手法极其隐蔽。
美国政府暂停Anthropic发布Fable 5和Mythos 5

美国政府以发现一个狭窄越狱漏洞为由,直接下令Anthropic停用已上线的Fable 5和Mythos 5,连内部外籍员工也不能用。Anthropic一边照办,一边公开反驳:这个攻击甚至不如其他模型的日常能力,并质问——如果所有模型都因发现一个非通用漏洞就停发,行业会怎样?
ShinyHunters 利用 Oracle PeopleSoft 漏洞发起教育行业攻击

ShinyHunters 利用 Oracle PeopleSoft 零日漏洞对高校发起定向攻击,68% 受害者是教育机构。这篇文章扒光了攻击者的完整操作链:从伪装 Azure 服务的 MeshCentral 到利用 .bash_history 记录窃取的 SSH 爆破脚本。
PyTorch 性能分析实战:从 nn.Linear 到融合 MLP 内核
别再盲目信任 torch.compile 了。这篇通过实际 PyTorch profiler trace 分析,精准指出单层 Linear 下编译器几无作用,而 MLP 中编译器的融合才是真功夫。核心思考方法是:看 trace 前先做预测,任何不匹配都是最有价值的发现。
安全对齐研究概述

AI对齐团队发布综述,表明未来AI系统可能突破当前安全假设,需发展更复杂保障措施,工作包括评估、压力测试,并列出近期多项对齐研究如宪法分类器、Bloom等。
AI 替代浪潮:当开源模型跨过足够好门槛

当所有公司都在抱怨模型变贵时,头部玩家已经在通过模型路由和后训练两种方式,一边保持 token 指数级增长一边把成本死死压住,甚至能做到效果更好成本只剩十分之一。
语音代理能搞定双语用户吗?代码切换ASR基准测评

测评了主流ASR模型在代码切换场景下的真实表现。发现ElevenLabs Scribe V2和Gemini 3 Flash最扛打、Whisper默认翻译会搞砸语义。最反直觉的是错误更多集中在嵌入的英语片段而非语言切换点。结论很干:服务双语客户前必须用自己的语言对做基准测试。
Anthropic可解释性研究:拆解大语言模型的内部工作原理

Anthropic的可解释性团队在系统性地拆解大语言模型的内部机制,从神经元激活到概念表示。自然语言自编码器直接把Claude的思维解码成文本,跨模型对比工具则能定位行为差异的具体电路。这不是玄学,是给AI安全铺硬路。