---
title: "大模型一夜降到对手3%，你的AI账单凭什么不降？"
date: 2026-08-27
category: AI大模型
site: 脑机网
canonical: https://aiai.cafe/a/njw-1b8086
language: zh-CN
---

# 大模型一夜降到对手3%，你的AI账单凭什么不降？

> 你有没有发现，最近用AI工具，好像没那么心疼Token了？

你有没有发现，最近用AI工具，好像没那么心疼Token了？

昨晚，阿里和智谱几乎同一时间放出两款开源大模型，把价格底线又砸穿了一层。阿里发布的Qwen3.8-Flash，1250亿参数只激活60亿就能跑，每百万Token输入1元、输出3元——大约是DeepSeek同类产品的三分之一。智谱的GLM-5.3-Flash更狠，定价直接打到Claude Opus 4.8的四十分之一，还首次大规模跑在国产芯片集群上。

两家同晚开源，这不是巧合，是信号。

价格战背后，到底在争什么大模型降价不是新闻，但这一轮的降幅让人侧目。阿里把训练成本砍掉了近90%，智谱把单Token成本压到了"比肩英伟达GPU"的水平。换句话说，同样的钱，能跑的模型量级翻了十倍不止。

这背后有一条清晰的逻辑链：开源模型倒逼闭源降价。DeepSeek年初用低价策略搅动市场，OpenAI不到一个月连续降价两次，谷歌Gemini 3.7 Flash直接半价首发，Anthropic干脆取消了原定涨价。福布斯把这叫做"价格逐底战"。

但对中国用户来说，真正的受益点在于：国产模型不是在打价格战，而是在打效率战。

普通人能薅到什么很多人觉得大模型降价是开发者的事，跟自己没关系。其实关系大了。

你用的每一个AI工具——写作助手、翻译软件、客服机器人、短视频脚本生成器——背后都在烧Token。模型便宜了，这些工具的订阅费迟早跟着降。更直接的是，很多原本要付费的AI功能，现在免费版就能用。阿里这次发布的Qwen3.8-Flash直接在千问AI平台上线，兼容OpenAI和Anthropic接口，普通用户也能白嫖。

还有一个被忽略的变化：智谱这次跑在国产芯片集群上。智谱之前火爆全网的匿名模型"牛来"（Ox Alpha）也正式认领并开源，使用量已达到DeepSeek的两倍以上。这意味着国产算力链开始跑通了，不再完全依赖英伟达GPU。长远来看，这比降价本身更值得关注。

**普通人现在能做什么：**

●如果你还没用过AI工具，现在门槛最低——千问、Kimi、智谱清言都有免费版，直接试

●如果你在用付费API，检查一下账单，换成Qwen3.8-Flash或GLM-5.3-Flash，成本可能降一半

●如果你做内容创业，别只盯着"哪个模型最强"，关注"哪个模型最便宜且够用"——性价比才是你的护城河

大模型的价格地板还在往下探。对普通人来说，这不是看热闹的事——AI正在变成水电煤一样的基础设施，越便宜，你能做的事就越多。

脑机派对

2026.08.27

---

来源：脑机网（https://aiai.cafe/）｜原文：https://aiai.cafe/a/njw-1b8086
本内容仅供参考，不构成投资建议。
