
AI消费的三波浪潮

OpenRouter 上的 agent 在 2026 年 2 月 6 日消耗的 token 超过人类,之后没有交还领先。文章认为,AI 消费无法用平滑曲线外推,而是分成三波,每波相差一个数量级。当前第二波已经展开,第三波在路。
第一波是聊天:人提问,模型回答一次,结束。作者估计每个活跃用户每天大约消耗 100 万 token。到 2026 年 6 月,聊天在企业使用中略超三分之一,Codex 占另外 64%,聊天已是企业输出的少数。
第二波是单个 agent:一边 vibe coding 做家庭周末运动排程应用,一边研究十年期国债与宏观经济含义。这类场景每天约消耗 1 亿到 2 亿 token。聊天与 agent 之间的 token 强度差为两个数量级。
第三波是在上面再叠一层 meta-harness:一个 AI 并行调度多个 agent,每个 agent 再产生自己的工具调用与子 agent。这再上一个数量级,单日消耗以十亿计。作者强调增长不是来自生成变快,而是来自并行化的复利。
作者给了另一个 meta-harness 的例子:假设一张 200 家 YC 初创公司的表格,30 列,每格不是数字而是一个 AI 的回答,每列代表几十次 AI 工具调用。这样一次运行在有人注意之前就会消耗几千万 token。
数据也显示同样趋势:OpenRouter 上 agent 的 token 用量从 0.51 万亿增至 7.3 万亿,六个月 14 倍,人类用量同期只有 2.8 倍。宏观层面,Goldman Sachs 预计到 2030 年消费者与企业 agent 每月消耗 120 千万亿 token,是 2026 年的 24 倍。
三波不是互相取代,而是叠加:聊天继续增长,agent 增长更快,meta-harness 将超过两者。如果按平滑外推来估算算力需求,很可能计划错。


