
最近,中国信息通信研究院披露的一组数据在业内刷屏:我国大模型日均Token(词元)调用量已突破500万亿。而在2025年7月的世界人工智能大会上,国家数据局局长刘烈宏给出的数字还是日均30万亿。不到一年,这个指标涨了十几倍。
很多人对词元调用量没什么概念,但它在行业内被视为观察AI产业最实在的窗口。参数规模可以宣传,榜单跑分可以优化,唯有调用量造不了假,它背后是真金白银的算力消耗,是企业和用户实打实的使用行为。
词元调用量,AI产业的用电量
先解释一下词元。大模型并不直接认字,而是把文本切成一个个最小单位来处理,这个单位就是词元。一个汉字大约对应一到两个词元,你在对话框里提一个问题,模型回答一段话,背后就是成千上万个词元的计算。
正因如此,调用量常被比作AI产业的用电量。工业化程度看用电量,AI渗透深度就看词元消耗。按国家数据局披露的增速折算,2024年初这个数字只有约1000亿,两年多时间增长数千倍,这条曲线比任何发布会都更有说服力。
500万亿是什么量级?按主流模型百万词元几元钱的定价粗算,仅推理环节每天就对应数亿元的市场规模,一年下来是千亿级体量。更关键的是,其中大部分来自真实业务需求,而不是评测刷量。
调用量从哪里来:应用落地进入深水区
消费端是肉眼可见的推手。豆包、DeepSeek的月活用户先后跨过亿级门槛,腾讯元宝、Kimi也积累了数千万量级用户,微信更是把DeepSeek接进了搜一搜,等于把AI助手直接送到十几亿用户手边。每一次日常问答,都在为这个数字添砖加瓦。
企业端的贡献其实更大,目前几类场景是词元消耗大户:
- AI编程:通义灵码、文心快码等工具进入研发流程,代码生成与补全极其耗费词元;
- 智能客服与营销:电商大促期间,数以万计的店铺同时调用模型生成话术和素材;
- 办公文档:WPS AI、钉钉等把模型嵌进写作、摘要、表格处理,用一次就是一次调用。
还有一个容易被忽略的变化:多家云厂商和芯片厂商都释放出同一个信号,推理需求已经超过训练,成为算力消耗的大头。这意味着AI产业的重心正从造模型转向用模型,500万亿的调用量正是这场转变的直接证据。
第一梯队的底气:能力追平与开源破局
用得多的前提是用得好。斯坦福大学《2025年人工智能指数报告》指出,2023年底中美顶级模型在基准测试上还有双位数差距,到2024年底已基本抹平。在LMArena等国际竞技场上,DeepSeek、通义千问、GLM、Kimi等中国模型长期位居前列。
开源策略功不可没。DeepSeek-R1用远低于同行的成本做出顶级推理能力,2025年初一度引发硅谷震动;阿里通义千问在Hugging Face上的衍生模型超过10万个,超越Meta的Llama,成为全球最大的开源模型族群。
开源的意义不止于名声。全球开发者基于中国模型做二次开发,工具链、社区、标准随之扩散,这种生态位才是第一梯队地位的深层支撑,比单点模型的领先更难被撼动。
水面之下:算力与成本的双重托举
海量调用跑在什么上面,同样值得看。华为昇腾、寒武纪等国产芯片在推理场景加速上量,各地智算中心陆续投运,三大运营商的智算规模持续扩张,为高并发调用提供了底座。
成本曲线同样关键。2024年5月,字节跳动把豆包大模型的价格打到百万词元0.8元,掀起一轮价格战,此后主流模型API价格普遍下降九成以上。越便宜越有人用,越用规模效应越明显,成本越低,这个正循环是500万亿能出现的直接原因。
500万亿之后,比赛换了个打法
当然,冷静看差距依然存在。前沿模型的探索、顶尖算力的储备、底层框架生态,与美国头部力量相比仍有距离。但中国的优势路径已经清晰:以应用纵深和工程化能力取胜,把模型能力快速翻译成千行百业的效率。
对普通人来说,这个数字意味着AI正从发布会里的参数,变成像水电一样的基础资源,学会用好它的回报会越来越直接。对从业者而言,机会不在再造一个通用大模型,而在具体行业里把调用量变成客户愿意付费的生产力。
500万亿不是终点,更像一个分水岭,AI产业的评判标准正从比参数转向比使用。Aiii人工智能创研院(Aiii.org.cn)会持续跟踪词元消耗、算力布局与落地案例,帮助更多人在这场换轨中找准自己的位置。
Aiii人工智能创研院(Aiii.org.cn)精选文章《日均500万亿词元背后:中国大模型靠什么稳居全球第一梯队》文中所述为作者独立观点,不代表Aiii人工智能创研院立场。如有侵权请联系删除。如若转载请注明出处:https://www.aiii.org.cn/1108.html
微信公众号
微信小助理