10 亿亿 Token:智能体时代的水表开始狂转
今天下午刷到央视新闻,说中国电信研究院发布了《智能体时代 AI 基础设施发展研究报告(2026)》,其中行业与企业战略研究所所长饶少阳提到,预计 2026 年我国 Token(词元)年消耗量将达到 10 亿亿,到 2030 年要超过 3500 亿亿,年复合增长率接近 12 倍。10 亿亿是什么概念,我盯着这个数看了好一会儿,才想起来上一次见到这么夸张的单位,还是小时候科普书里形容天上的星星。
先解释一下这个词。Token 是大模型处理文字的最小单位,一句话先被切成若干词元,模型读懂词元再吐出词元,训练和调用都按它计价,你可以把它理解成 AI 世界的字数,或者更直白一点,AI 时代的水表读数。一本 20 万字的长篇小说,粗略折算要消耗二三十万个词元,拿 10 亿亿除下来,相当于全国 14 亿人平均每人每年用掉 7000 多万词元,摊到每天差不多 20 万,等于每个人每天都在让模型通读一整本长篇小说,读完还得写一份像模像样的读后感。
为什么到了智能体时代,词元烧得这么凶?过去用大模型,基本是一问一答,你问一句它答一段,消耗是可控的。智能体不一样,接到任务之后要自己拆解步骤、检索资料、调用工具、检查结果,一轮不满意就再来一轮,上下文越滚越大,同一个任务吃掉的词元可能是聊天模式的几十倍。词元消耗暴涨,本质上是机器开始真正替人干活了,而干活是要论斤称的,以前你只是偶尔找 AI 聊两句,现在是雇了个不知疲倦的员工。
报告里还有一个判断,人工智能产业的重心正在从大模型和算力的竞争,转向智能体的规模落地与应用变现。这话翻译过来就是,模型层的故事讲得差不多了,接下来拼的是谁能把智能体真正用起来、卖出去,而所有这些用量最终都会沉淀在词元的账单上。业内已经有人开始把这叫做“词元经济”,词元正在从技术术语变成一种计量经济活动的新单位,就像几十年前大家学会用流量衡量一个互联网公司的体量。
这份报告也并不是孤证。前几天看到一条数据,全球模型聚合平台 OpenRouter 统计,8 月底那一周中国大模型的周调用量达到 55.16 万亿词元,已经连续 18 周排在全球第一。运营商的动作更直白,中国联通在数博会上把展台的主线词直接换成了“词元”,中国电信干脆把报告名字定为“智能体时代”,各家都在抢着给这个新时代定调,毕竟这个词要是成了通用计量单位,谁定义它谁就握住了话语权。
对基础设施来说,12 倍的年复合增长率意味着建设的重心要挪位置了。过去几年大家争的是训练算力,谁的集群卡多、谁先把大模型跑出来,可训练是阶段性投入,推理才是日常开销。词元消耗翻多少倍,推理侧的芯片、网络和数据中心就得跟着扩容多少倍。这份报告既然叫 AI 基础设施发展研究报告,落点其实在这里:智能体时代的基础设施,是按词元的流量来设计和计费的,更像运营商熟悉的电信业务,按用量收钱,而不是一次性的军备竞赛。
我自己的体感也对得上这个曲线。这一年用智能体改代码、整理资料、跑些杂活,用量几乎是陡着往上走的,以前一个月用不完的额度,现在一周就见了底。而且一旦养成习惯就回不去了,很多原本自己动手的小事,都会顺手丢给智能体,单次看起来不起眼,架不住次数多,月底一看账单常常会愣一下。
当然,预测终究是预测,12 倍这种量级的推算,本身就是落在一个很宽的区间上,应用落地的节奏、推理成本下降的速度、商业变现的成色,任何一个变量都可能让曲线变形。但方向大概率不会错,智能体正在从演示品变成日常工具,词元的消耗曲线背后,其实是机器替人干活的工时曲线,而工时这个东西,向来只会越用越多。
比较有意思的倒是计量单位本身。亿亿这个词,小时候只在数星星的时候听过,如今拿来数词元。在电表、水表和流量表之后,家里说不定真的会多出一块词元表,月底缴费的时候,你会认真看一眼,这个月到底用了多少亿亿。