AI 应用

JetBrains 发布 Mellum2:专注低延迟文本代码任务的 12B MoE 模型

JetBrains 开源了一个 12B 的 MoE 模型 Mellum2,总参数 12B 但只激活 2.5B,速度快 2 倍以上,专注文本和代码任务。思路很清晰:不做通用大模型,而是做一个高效、可私有部署的"工具人",专门处理路由、RAG、子代理这类高频但不需要顶级算力的任务。

阅读详情JetBrains 发布 Mellum2:专注低延迟文本代码任务的 12B MoE 模型