邬贺铨:2030年中国算力有望达全球三成
「中国工程院院士邬贺铨在2026中国算力大会上指出,智能体的出现带动了Token消费,今年3月Token日均消费已达140万亿,且应用成本持续下降。他表示算力与Token成正比,中国算力目前占全球21%,按国家算力网规划2030年有望达到30%。」
在2026中国算力大会主论坛上,中国工程院院士邬贺铨围绕智能体与Token消费的关系分享了最新观察。他指出,智能体的出现显著带动了Token的消费规模,今年3月,Token的消费已经达到日均140万亿。这一数字背后,是人工智能应用从对话式交互向自主任务执行演进的直接体现。智能体在完成复杂任务时需要反复调用模型、拆解步骤、校验中间结果,Token消耗因此呈现出与传统问答截然不同的增长曲线。
值得注意的是,邬贺铨强调,随着技术进步,Token的消耗并不是以多为荣,而是以效率为荣。这一判断指向了行业竞争重心的转移:单纯堆叠调用量并不能代表技术实力,如何在完成同等任务的前提下降低Token开销,才是模型能力、推理优化与工程架构共同作用的结果。与此同时,中国Token的应用成本不断下降,这也促进了Token的利用,成本与用量之间由此形成正向循环。
Token与算力之间存在直接的映射关系。邬贺铨表示,Token带动算力,算力和Token之间成正比。也就是说,Token消费规模的持续攀升,最终会传导为对底层算力资源的刚性需求。从全球格局看,目前中国的算力在全球占21%,美国占46%。按照国家算力网的规划,2030年中国算力有望占到全球30%,这意味着未来数年国内算力供给仍需保持较高增速。
需求侧的预测同样激进。中国电信研究院行业与企业战略研究所所长饶少阳表示,预计2026年我国Token年消耗量将达到10亿亿,到2030年将超过3500亿亿,年复合增长率接近12倍。这一量级意味着,推理侧算力将逐步取代训练侧,成为算力消耗的主力,数据中心的建设思路、网络互联结构与能耗管理方式都需要随之调整。
从技术视角看,支撑这一趋势的关键在于几个方向:一是模型侧的单位Token成本优化,包括稀疏化、量化、蒸馏以及更高效的注意力机制;二是推理侧的系统工程,如批处理调度、前缀缓存、算力资源池化与跨节点并行;三是智能体框架自身的效率,例如减少无效循环、压缩上下文、复用中间结果。当Token从计费单位变成效率指标,围绕单位算力产出Token数量、以及单位Token完成有效任务数量的优化,将成为未来几年AI基础设施竞争的核心议题。
来源:Heooo AI工具导航