谁在买最先进的AI模型?

这篇短文用数据回答了一个反直觉的问题:谁在买最先进的AI模型(SOTA)?答案是——很少人在买。

核心事实:SOTA模型在8个月内性能提升了约2/3,实验室平均每3天推出两个新模型。但OpenRouter上84%的token并非来自SOTA模型。实际上,承担绝大部分流量的六个模型,性能约为前沿水平的77%,价格仅为Claude Fable 5的2.5%(混合价格$0.50/百万token vs $20/百万token)。当Fable 5降价到约$10/百万token时,一个月后只占Anthropic总token的6%和花费的11%。OpenAI最贵的GPT-5.6 Sol持有约四分之一的OpenAI token。Fable 5在7月产生的模型归属收入约为GPT-5.6 Sol的75%,尽管它贵得多。每个新的SOTA版本应该比前一个夺得更少的份额。

企业端在整合开支,合同集中在一两家供应商,类似云计算时代。一旦模型通过高价值任务的门槛,工作负载就会锁定。性能在显着折扣下已经足够好——差距从下方不断缩小。最佳开源模型在5月达到了前沿得分的80%,而一年前只有48%。

应用部署是另一个故事。更多投资组合公司和初创公司默认使用更小的模型、微调模型和开源模型。他们在优化不同的帕累托前沿:价格优先于性能。如果份额停止转移,而“足够好”保持足够好,SOTA的经济学就会改变。一个九位数的训练运行必须赢得份额才能收回成本,而这个门槛会随着时间上升。

标题是轻率的。并非没人买SOTA——在软件工程架构和安全性设计上,最好的模型确实物有所值。但公开数据表明,真正重要的前沿是另一个(性价比前沿)。

Honestly, Who Buys SOTA?

查看原文