触手可及的工作:OpenAI 发布 GPT-6 Astra 与自研推理芯片

OpenAI 首席财务官 Sarah Friar 发表文章,阐述 AI 能力扩展如何让原本受限于时间、成本或专业门槛的想法变得可行,并系统梳理 OpenAI 在模型、产品、计算三方面形成的正循环:更好的模型打开新工作,更高效的计算让工作以更大规模变得可负担,增长带来的收入再反哺下一轮研究与基础设施。

文章披露几项关键数据。产品层面,OpenAI 每周活跃用户超 10 亿,企业客户达 250 万;个人订阅用户六个月后日均消息量比首月高约 50%,尝试的不同任务数量约为两倍。研究团队内部,AI 代理已承担每 1 个人类工作日的 3.1 个代理工作日工作量,研究人员将更复杂任务委托给代理,自己聚焦优先级判断与结果评估。

模型进展方面,GPT-6 Astra 被描述为当前最智能且最对齐的模型,在计算机使用、浏览、软件工程、网络安全、科学和专业工作等领域达到最新水平。GPT-5.6 Sol 则帮助优化生产级推理服务软件,端到端服务成本降低 20%,token 生成效率额外提升 15% 以上。

硬件层面,OpenAI 自研首款推理芯片 Jalapeño,在 InferenceX 测试中对三款公开模型,每瓦峰值 token 吞吐量是所测商用系统的 1.5 至 1.9 倍,端到端延迟低 1.7 至 3.6 倍。计划 2025 年底开始部署,与 NVIDIA、AMD 等合作伙伴的加速器并行使用。OpenAI 强调其”全栈计算策略”覆盖数据中心、芯片、软件、模型与产品,根据负载特性决定自研还是外购,以灵活平衡性能、速度、可靠性、效率与成本。

文章还阐述消费者与企业业务相互增强的逻辑:家庭场景建立的熟悉感带入工作场景,企业部署提供适合复杂任务的工具,工作中的体验又反过来提升个人对 AI 的预期。代理产品未来将进一步模糊个人生活与工作场景的边界。免费访问加广告的模式帮助用户发现 AI 用途,订阅和按量付费让客户随价值提升而增加支出。

资本纪律被视为可持续增长的关键,每项投资依据可服务需求、投产速度和资本回报来评估。文章结论是,这些优势的叠加让 OpenAI 有信心在持续多代 AI 演进中保持领先,帮助人们在每次进步中实现更多成就,同时建立随用户抱负一起增长的业务。

The Work Now Within Reach

查看原文