截至 2026 年 6 月,我国日均词元调用量已突破 500 万亿,中国大模型在全球竞争中位居第一梯队。当前旗舰模型几乎以月为单位更新,竞争焦点转向智能体落地与生态建设,推理算力需求随之爆发。腾讯混元 3 正式版上线第一周,Token 调用量比上一代混元 2 增长 68 倍。## 词元爆发的信号词元是大模型处理信息的最小单元。从 2024 年初日均 1000 亿词元,到 2026 年 6 月的 500 万亿,两年增长超千倍,折射出产业从「百模大战」参数比拼全面转入规模化应用深水区。全球对比更具说服力:OpenRouter 数据显示,2026 年 6 月 15 日至 21 日当周,中国 AI 大模型周调用量达 18.81 万亿词元,连续八周稳居全球首位,美国同期仅 5.76 万亿。国产大模型包揽全球前四席位,打破海外长期主导格局。

中国AI调用量连续八周领跑
迭代加速与竞争转向稀宇科技首席架构师冯雯指出,2025 年下半年各厂商计划每三个月迭代一次,如今每四到六周就要发布新模型。迭代速度急剧压缩,意味着竞争重心从「模型智商」转向智能体落地与生态建设。智能体规模化落地是本轮爆发的核心驱动力——一次任务需反复检索、读取上下文、调用工具、多轮反馈,推理算力呈指数级增长。腾讯智慧产业总经理刘峰披露的数据印证了这一点:混元 3 首周 Token 调用量较混元 2 增长 68 倍,这是应用侧需求爆发的直接体现。

智能体落地驱动推理需求