你有没有想过,全世界的 AI 都在忙什么?
就在上周,OpenRouter 公布了一组数据:全球大模型一周总调用量 113 万亿 Token,其中中国上榜模型的调用量是 55.16 万亿,环比再涨 36%,连续第十八周压过美国。
更扎眼的是前三名:智谱 GLM-5.3-Flash、DeepSeek-V4-Flash、小米 MiMo-V2.5,清一色国产。智谱那个匿名模型"Ox Alpha"被认领后,大家才发现就是 GLM-5.3-Flash——单周 15.7 万亿调用,全球登顶。
一、Token 是什么?它凭什么衡量 AI 的"工作量"
Token 是 AI 处理文字的最小单位。一句话拆开,英文大约一个单词算一个,中文通常一个字到两三个字算一个。
你每次让 AI 写一段话、分析一张图、改一份合同,都在消耗 Token。所以"周调用量"翻译成人话就是:全世界的人这一周实际用了多少次 AI。
55 万亿是什么概念?按每 1000 Token 约 700 字计算,相当于一周"读"了 3.8 万亿字——把《红楼梦》读 19 亿遍都绰绰有余。
二、为什么偏偏是"便宜"的模型登顶
调用量冠军不是最强的模型,而是最划算的模型。
GLM-5.3-Flash 是 GLM-5 系列首个原生多模态版本,看图、读视频都能干,定价却只有 GLM-5.3 的十分之一,限时甚至降到二十分之一,还直接开源。
DeepSeek 的 V4-Flash-Vision-Exp 同晚开源,在真实软件工程测试里以 59.3% 反超了 Opus-4.8。一边能力不差,一边价格打到地板——开发者当然用脚投票。
这背后还有一个信号:8 月 31 日工信部发文,明确要"加大大模型、智能体、Token 等服务采购力度"。国家开始把 Token 当"水电"一样集中采购,机构测算今年算力租赁市场规模要破 2600 亿元。
三、便宜,到底便宜了谁
对普通人的影响,比想象中直接。
做副业的人最先受益。写文案、做翻译、写代码,以前用顶级模型心疼钱包,现在国产开源模型免费或几毛钱就能跑,一天几百次调用不心疼。
用 AI 帮自己办事的人受益。以后手机里的语音助手、办公软件、甚至银行客服,底层都能换用更便宜的国产模型,服务成本降了,要么免费,要么服务质量上去。
学生和创业者受益最大。开源意味着任何人可以下载部署,等于把"顶级大脑"的成本打到了零。
四、普通人现在能做什么
1.去 OpenRouter 或各大模型官网薅免费额度,实测不充值每天也有免费调用次数,先把自己的常用任务(写周报、翻译、查资料)迁上去。
2.关注你正在付费的软件——如果它用的是贵价模型,留意近期的降价或换国产模型的公告,该改订阅就改。
3.别急着为"AI 能力"付费,先用免费开源模型验证需求,真不够再升级,大多数人到不了付费那一步。
金句留在这里:AI 的价格战才刚开始,急的不是钱包,是钱包的用法。
脑机派对
2026.09.01