预览超快速模式:GPT-5.6 Sol 速度提升14倍

OpenAI 今天发布了 Ultrafast 模式的早期预览,运行 GPT‑5.6 Sol 模型,速度比标准处理快 14 倍,最高输出 750 tokens/秒。该服务基于 Cerebras 硬件,首先在 OpenAI API 中推出。

之前的实时速度通常意味着选择更小或更专门的模型。Ultrafast 的方向是:在不牺牲智能的前提下提升每秒的有效工作。OpenAI 列举了若干有潜力的场景:故障时实时分析日志和代码变更以快速定位问题;金融领域同时分析市场信号和交易行为以识别可疑活动;客服中不中断对话地解决需要多步查询的复杂问题;电商场景下在用户犹豫期间完成产品问答、库存检查、个性化推荐和结账协助;研究团队将原本需要过夜运行的实验变成交互式会话,一天内可多次迭代。

预览期间,OpenAI 正与首批客户在编码、电商、金融研究、客服等领域合作,研究速度量级提升在哪创造最大价值,以及产品如何随模型跟得上用户节奏而改变。OpenAI 内部团队也在使用 Ultrafast 进行事件响应:警报触发时快速读取日志、分析追踪、合成对话、验证修复方案,缩短从观察到行动的时间。研究团队则用它快速搜索知识源、查询数据、整理信息,将原本过夜的实验循环压缩到工作日内多次迭代。

Ultrafast 是 OpenAICerebras 合作的下一步,为平台带来超低延迟推理。GPT‑5.6 Sol 是 OpenAI 目前最智能的模型,现在通过 Cerebras 实现实时响应。当前为有限预览,仅对特定客户开放,后续将根据容量逐步扩大。

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

查看原文