短短八周,五款国产旗舰大模型接连亮相。2026年8月5日,OpenRouter全球模型调用榜单前五已全部被中国大模型占据——DeepSeek、Qwen、Kimi、智谱与字节豆包依次登顶。这是国产大模型首次在同一周内完成对全球头部调用量的"全包围"。
把日历往前翻:6月底DeepSeek V4-Flash、Qwen3.8、Kimi K2、智谱GLM-5、字节Doubao Pro 1.5 几乎以周为单位发布更新,模型迭代节奏从此前的"季度"压缩到"周"。机构高盛在8月4日的最新研报中,将OpenAI的年化收入预期(ARR)上调至130亿美元,但同时指出"中美头部模型的单位推理成本差距已收窄到1:3以内"——这一价格带的拉平,是OpenRouter前五尽归中国的直接推手。
调用量迁移的背后是更便宜的中国Token。Qwen3.8输入价0.3元/百万Token、DeepSeek V4-Flash缓存命中价0.1元/百万Token,相比GPT-5同等性能下便宜一到两个数量级。SaaS公司、跨境电商团队、量化私募、海外开发者社区都在主动切换。"以前选模型看榜单,现在选模型看预算"——一位AI工作室主理人在AIGC线上沙龙上这样总结。
对创业者来说,模型层不再是壁垒,应用层才是。8月5日同一天,AutoGLM开放平台日调用量突破1.2亿次,Manus企业版ARR跑过2亿元。这说明:国产模型把"智能"打成白菜价后,真正稀缺的是懂行业、懂工作流、能交付结果的AI工作室与OPC超级个体。
一个OPC搭建AI咨询工作室的标准路径是:先用Qwen/DeepSeek/智谱三件套搭出"基础模型+私有知识库+多Agent协作"的中台,再切入一个细分行业(跨境电商财税、券商研报摘要、律所合同审查),把行业know-how沉淀成Prompt模板和工作流脚本,最后靠AIGC沙龙/直播课+企业内训实现冷启动变现。这条路不再需要百万级启动资金,一人一电脑七天内就能跑通MVP。
九大赛道第一个赛道正在从"卷参数"转向"卷落地"。接下来的故事,将由那些把模型嵌进真实工作流的人书写。
一个值得关注的"二线"现象是开源生态。Qwen3.8、DeepSeek V4-Flash、Kimi K2三个模型在HuggingFace的下载量,单月合计突破1800万次,全球前三。开源能力的溢出让"中国模型"成为海外中小开发者的默认选择。东南亚、拉美、中东的SaaS公司大量采用Qwen做底座,这反过来又强化了中国模型的事实标准地位——这是大洋彼岸最担心的事,也是一线开发者愿意把中国模型放进生产环境的最朴素理由。
更直接的成本信号来自Token价格。8月5日Qwen团队宣布Qwen3.8-Lite降价40%,百万Token输入价跌至0.18元,再次刷新业内底价。豆包、智谱、Kimi随后跟进降价。模型层的价格战已经把"调用成本"压到了可以忽略不计的程度,应用层的单位经济学才真正打开——这是AI应用爆发最朴素、也最坚实的底层逻辑。
脑机派对 · 2026.08.05