iFeeling Daily
每天精选值得关注的 AI 动态
Cohere 发布首个开发者模型 North Mini Code

Cohere 用一个 3B 活跃参数的 MoE 模型,在编码 Agent 任务上碾压了 Gemma 4 和 Qwen3.5 等大模型。关键不是模型架构,而是一套聪明的多环境联合强化学习和跨 harness 训练策略。想看 Agent 模型到底该怎么训,这篇是很好的实操样本。
Anthropic 的经济学研究:用 81,000 人数据量化 AI 的真实影响

Anthropic 搞了个经济追踪器,不玩虚的,直接扒了 81,000 个 Claude 用户数据和 10 万段真实对话。结果发现 AI 确实把任务时间平均砍掉了 80%,并且精确划分了 AI 在不同行业和岗位的真实使用模式。这是把 AI 经济学从玄学变成了实证科学。
物理学的最大未解之谜:反物质、暗能量与万物理论

Fermilab 物理学家 Don Lincoln 细聊反物质消失、暗能量本质和万物理论的现状。他指出宇宙中 95% 是未知物质,当前理论物理面临量子力学与相对论无法统一的根本困境,实验才是检验一切的最终标准。
开放模型生态的崛起:69%市场份额背后的竞争逻辑

OpenRouter 的真实数据显示,开放权重模型已占据 API 前沿市场 69.1% 的流量,封闭模型被压缩到三成。这个数字戳破了一个神话:开发者不是嘴上喊着要用开源,实际上身体却很诚实——生产流量正在大规模迁移到开放模型。
开放模型生态的崛起:69%市场份额背后的竞争逻辑

OpenRouter 的真实数据显示,开放权重模型已占据 API 前沿市场 69.1% 的流量,封闭模型被压缩到三成。这个数字戳破了一个神话:开发者不是嘴上喊着要用开源,实际上身体却很诚实——生产流量正在大规模迁移到开放模型。
JetBrains 发布 Mellum2:专注低延迟文本代码任务的 12B MoE 模型

JetBrains 开源了一个 12B 的 MoE 模型 Mellum2,总参数 12B 但只激活 2.5B,速度快 2 倍以上,专注文本和代码任务。思路很清晰:不做通用大模型,而是做一个高效、可私有部署的"工具人",专门处理路由、RAG、子代理这类高频但不需要顶级算力的任务。
Google SRE如何用Agentic AI改进运维

随着微服务架构普及和AI代码生成能力增强,Google内部的系统复杂度已远超过去。跨地域分布、硬件多样性、持续部署带来的频繁变更,以及开发团队交付代码量级的增长,都让传统的SRE方法面临更大压力。但AI本身也在提…
VSAS-Bench:流式视觉助手模型的实时评估

新基准VSAS-Bench评估流式视觉助手,含18000+标注,引入主动性和一致性指标,Qwen3-VL-4B在异步协议下超越Dispider 3%。
研究:浏览器安全已成为 IT 领导者的首要任务

92% 的组织已允许员工使用公共 GenAI 应用,但调研显示超过一半在过去一年遭遇浏览器安全攻击。关键洞察是:在浏览器成为工作主界面的时代,把安全控制内置到浏览器层,比依赖传统网络代理更适应云+AI 环境。