AI 模型

Claude Opus 4.8 发布:更诚实、更可控的 AI 合作伙伴

Opus 4.8 的核心进步不是跑分更高,而是开始学会说“我不确定”。它会在代码有漏洞时主动指出、方案不靠谱时反驳,这对企业级 Agent 的信任建立是质变。配合动态工作流和努力控制机制,大模型终于开始像一个严谨的同事,而不是那个永远自信满满却总留坑的新人。

阅读详情Claude Opus 4.8 发布:更诚实、更可控的 AI 合作伙伴

JetBrains 发布 Mellum2:专注低延迟文本代码任务的 12B MoE 模型

JetBrains 开源了一个 12B 的 MoE 模型 Mellum2,总参数 12B 但只激活 2.5B,速度快 2 倍以上,专注文本和代码任务。思路很清晰:不做通用大模型,而是做一个高效、可私有部署的"工具人",专门处理路由、RAG、子代理这类高频但不需要顶级算力的任务。

阅读详情JetBrains 发布 Mellum2:专注低延迟文本代码任务的 12B MoE 模型