你有没有发现,最近用AI工具,好像没那么心疼Token了?
昨晚,阿里和智谱几乎同一时间放出两款开源大模型,把价格底线又砸穿了一层。阿里发布的Qwen3.8-Flash,1250亿参数只激活60亿就能跑,每百万Token输入1元、输出3元——大约是DeepSeek同类产品的三分之一。智谱的GLM-5.3-Flash更狠,定价直接打到Claude Opus 4.8的四十分之一,还首次大规模跑在国产芯片集群上。
两家同晚开源,这不是巧合,是信号。
价格战背后,到底在争什么
大模型降价不是新闻,但这一轮的降幅让人侧目。阿里把训练成本砍掉了近90%,智谱把单Token成本压到了"比肩英伟达GPU"的水平。换句话说,同样的钱,能跑的模型量级翻了十倍不止。
这背后有一条清晰的逻辑链:开源模型倒逼闭源降价。DeepSeek年初用低价策略搅动市场,OpenAI不到一个月连续降价两次,谷歌Gemini 3.7 Flash直接半价首发,Anthropic干脆取消了原定涨价。福布斯把这叫做"价格逐底战"。
但对中国用户来说,真正的受益点在于:国产模型不是在打价格战,而是在打效率战。
普通人能薅到什么
很多人觉得大模型降价是开发者的事,跟自己没关系。其实关系大了。
你用的每一个AI工具——写作助手、翻译软件、客服机器人、短视频脚本生成器——背后都在烧Token。模型便宜了,这些工具的订阅费迟早跟着降。更直接的是,很多原本要付费的AI功能,现在免费版就能用。阿里这次发布的Qwen3.8-Flash直接在千问AI平台上线,兼容OpenAI和Anthropic接口,普通用户也能白嫖。
还有一个被忽略的变化:智谱这次跑在国产芯片集群上。智谱之前火爆全网的匿名模型"牛来"(Ox Alpha)也正式认领并开源,使用量已达到DeepSeek的两倍以上。这意味着国产算力链开始跑通了,不再完全依赖英伟达GPU。长远来看,这比降价本身更值得关注。
普通人现在能做什么:
●如果你还没用过AI工具,现在门槛最低——千问、Kimi、智谱清言都有免费版,直接试
●如果你在用付费API,检查一下账单,换成Qwen3.8-Flash或GLM-5.3-Flash,成本可能降一半
●如果你做内容创业,别只盯着"哪个模型最强",关注"哪个模型最便宜且够用"——性价比才是你的护城河
大模型的价格地板还在往下探。对普通人来说,这不是看热闹的事——AI正在变成水电煤一样的基础设施,越便宜,你能做的事就越多。
脑机派对
2026.08.27