在上海盛夏的蝉鸣中,WAIC 2026的热度席卷了每一个展台。人潮涌动,目光在展板文字与展商面孔间不断切换,无数参会者心中都带着同一个问题:中国的人工智能产业,到底走到了哪一步?雷峰网特别策划了WAIC 2026观察报道,通过与8位参展AI基础设施(AI Infra)公司的决策者深入对话,试图捕捉今年行业真正关心的焦点,以及正在形成的新方向和新共识。
从拼规模升级为比效率,这是今年最显著的趋势。无论是CEO还是业务负责人,都不约而同地提到同一件事:行业关注的重心发生了根本性转变。过去,人们更多在谈论千卡集群、GPU性能等硬件指标;而现在,话题已转向如何稳定、低成本地批量产出Token,以及如何利用这些Token去支撑Agent和AI应用的持续稳定运行。市场数据清晰印证了这一转变:2025年全市场Token调用量同比暴涨300倍,头部大模型企业的增长已完全由API和Token调用拉动。以智谱为例,其年化收入从预期的7亿突破至10亿美金,增长核心全部来自推理侧规模化调用。据Gartner测算,推理目前已经占到企业AI计算支出的65%以上。这不再是一场“谁有更多卡谁就是赢家”的规模竞赛——用产出衡量能力,是推理时代的必然。九章云极市场部负责人陈庶观察到,去年大家还在讨论如何把模型训练出来,今年讨论已变成“如何让模型规模化地跑起来”。推理效率、调度能力、成本管控替代了算力规模,成为展台和论坛上最高频的词。首都在线COO董直烨提到,行业的关注点已经从“算力资源的有无和规模大小”,转向了“算力的落地效率与价值确定性”。并行科技董事长、CCF中国计算机学会副理事长陈健指出,前两年行业算力需求基本是训练和推理各占一半,但今年随着AI Coding、小龙虾式自主智能应用批量落地,推理需求被推到了绝对主导地位。陈健将其概括为行业共识:2026是AI大规模商业化元年,推理才是算力消耗的长期主体。
如果说Token是AI时代的石油,那Agentic AI就是那个轰鸣的内燃机。Agent正在推动AI从“生成内容”走向“完成内容”,在执行任务的过程中不断调动多个模型、多个工具,这会带来比传统单轮问答成百上千倍的Token消耗量。当AI Coding、智能客服和企业Agent等场景成为业务板块的一部分,单次请求将面临更复杂的任务,也会更频繁地调用工具——毫无疑问,Agent的消耗速度绝非人类可比。PPIO的创始人兼CEO姚欣给出这样的判断:现在人类和Agent的Token消耗量还能打个平手,但未来Agent才会是Token的第一用户。“99%的Token都会由Agent消耗,而不是人类。”这一观点在展台间引发广泛共鸣,意味着AI基础设施必须为Agent的爆发式需求做好准备。
这场转变的影响深远。首先,AI Infra厂商需要重新定义产品方向:从堆砌算力转向提升效率,从关注硬件规模转向优化软件调度和成本控制。其次,Agent的崛起将重塑整个AI生态,推动Token消耗量呈指数级增长,进而倒逼基础设施的持续迭代。对于企业而言,这意味着必须提前布局推理侧能力,否则可能在Agent驱动的竞争中掉队。WAIC 2026传递出的信号清晰而有力:中国AI产业正从“训练竞赛”迈向“推理应用”的新阶段,效率与确定性将成为未来竞争的核心。
