iFeeling Daily
每天精选值得关注的 AI 动态
LVSum:时间感知的长视频摘要基准

长视频摘要的真相:模型严重依赖转录文字,视觉帧几乎不贡献;而且它们对时间顺序的理解一塌糊涂。如果你做视频AI,LVSum是检验模型真实能力的试金石。
Anthropic 罕见病研究资助计划:用AI打通治病信息孤岛

Anthropic 为罕见病研究开了个新资助计划,两个赛道:基础科研和早期生物科技。核心思路很具体——用 Claude 打通分散的疾病知识,加速药物开发的文书和审批环节。值得关注的不只是钱,而是他们和 Monarch 正在搞的 agent 友好型疾病分类库。
Panasonic vSkipGen在Axion C4A-metal上运行

想用云原生方式开发汽车座舱软件?Panasonic的vSkipGen平台在Google Cloud Axion裸金属上实现了CDC数字孪生,利用远程GPU渲染让全球团队实时协作,彻底摆脱物理硬件依赖。
YouTube 细化 AI 内容变现规定

YouTube 正式细化 AI 内容变现规则,明确禁止三类低质量视频:模板化重复内容、刻意博眼球的痛苦视频、以及用 AI 角色讨论敏感话题。这不是封杀 AI,而是在给 AI 创作的收益划定清晰底线。
黄仁勋访日之后:物理AI成日本战略核心

黄仁勋访日敲定多项合作:日本斥资62亿美元打造主权AI工厂Noetra,机器人巨头联手NVIDIA Cosmos模型,丰田扩大采用Drive平台。物理AI成为日本工业复兴核心,但硬件仍依赖美国芯片。
苹果起诉OpenAI:硬件计划会受阻吗?

苹果起诉OpenAI窃取商业机密,超过400名前员工跳槽。这场诉讼不仅威胁OpenAI的硬件产品(手机智能音箱),还可能搅乱其IPO估值。OpenAI曾硬扛Elon Musk的诉讼,这次可能也不会轻易和解。商业和法律的双重博弈值得关注。
非营利组织Current AI正竞相为所有人构建AI的万维网

当主流AI只服务英语世界时,一个非营利组织联合多国政府与基金会,用开源、离线、本地化的方式,为印度22种语言打造了口袋AI设备。它证明:公共AI基础设施可以像万维网一样免费开放,而且数据主权必须回归社区,而不是硅谷。
Vertu 6880 美元 AI 手机实测:硬件贴牌,Agent 未熟

Vertu 把一台 ZTE 贴牌折叠屏,套上真皮卖到 6880 美元,核心卖点是一个叫 Hermes 的 AI 代理。实测发现它比 Gemini 更敢“自动执行”,但出错率高、记不住上下文——花七倍钱买到的奢侈品体验,更像一个尚未完成的实验品。
从图像集合推断视觉概念

视觉语言模型无法从少量示例图像中推理出共享概念,作者提出VICIS任务和训练框架,让模型学会提取概念嵌入,生成更准确多样的图像,甚至能泛化到未见概念和草图模态,推动AI从“听指令”转向“看例子”。