脑机网 脑机网LOGIC.WANG
ESC

DeepSeek把API砍价60%,你的AI会员费会跟着降吗?

有个做 AI 写作工具的朋友,上个月跟我吐槽:模型没变、用户没涨,账单却比年初翻了一倍。

2026-09-09 · 1409 字 · 脑机网

有个做 AI 写作工具的朋友,上个月跟我吐槽:模型没变、用户没涨,账单却比年初翻了一倍。

他盯着后台那串数字算了半天,憋出一句:"我到底是在买智能,还是在买电?"

9月9日,DeepSeek 开放平台发了一份公告,可能要改写他这句吐槽。

一、9月10日中午,价格真的往下走了

公告说得很直白:自北京时间 9 月 10 日 12:00 起,调整 Flash 系列大模型的 API 调用价格,继续采用峰谷分时计费。

新的空闲时段价格:

  • 输入缓存命中:0.02 元 / 百万 Token
  • 输入缓存未命中:1 元 / 百万 Token
  • 输出:4 元 / 百万 Token

高峰时段(周一到周五 9:00–12:00、14:00–18:00)各项价格翻倍。

对照旧版,空闲时段缓存命中的输入单价降了 60%,缓存未命中降约 33%,输出降约 11%。

注意这个顺序:降得最狠的,是"缓存命中"。

二、为什么偏偏是"缓存命中"降最多?

这三个字听起来技术,其实特别生活。

缓存命中,意思是"你问的东西,模型刚处理过类似的"。比如你拿同一份产品说明书,批量问一百个问题;比如一个智能体每天早晨固定读一遍你的日报再生成摘要;比如客服机器人反复引用同一份话术库。

这些场景有个共同点:重复、高频、量大。

过去这类活最烧钱,因为每一轮都要重新"读"一遍上下文。现在把这部分砍掉六成,等于直接给"让 AI 常驻干活"松了绑。

这不是给聊天用户打折,是给"让 AI 干活"的人发补贴。

而输出只降 11%,也很说明问题:模型真正"想"的那部分,成本还没降下来。降的是记忆,不是思考。

三、8月刚调过价,9月又降,图什么?

今年 8 月,DeepSeek 才优化过一轮峰谷计费规则,还推出周末统一低价。一个月后再动主力推理模型价格,动作不算小。

绕不开的背景是:对手正在密集压上来。

智谱的 GLM-5.3 已作为公开下载放出;腾讯混元 Hy4 preview 开源了 770B 的 MoE;面壁智能 9 月 8 日联合 OpenBMB 开源 MiniCPM5-2B,2B 的体量在 4B 以下开源模型里排第一。

模型差距在肉眼可见地收窄,这时候价格就是最直接的分流阀门

还有一个更狠的变量:Anthropic 的 Claude Fable 5.1 在保持原有定价档位的同时,把缓存读取成本砍掉了 75%。

大家默契地在同一块地方降价,说明行业已经算清账了——未来真正走量的不是"人问一句",是"机器干一天"。

四、这跟你有什么关系

先说一句可能不太中听的:这次降价大概率不会立刻体现在你的 AI 会员上。

API 是给开发者的批发价,会员是给个人用户的零售价,中间隔着一整层定价策略。但它会通过三条路慢慢渗过来:

  • AI 功能会更"耐用":以前为省钱,产品会限制你每天问多少轮、传多长文档,成本下探后这类限制会松
  • 常驻型 AI 会变多:能记住你三个月前的偏好、每天自动处理琐事的助手,以前贵得离谱,现在开始划算
  • 小团队的 AI 工具会更便宜:你用的那些几十块一个月的小工具,成本压力小了,降价空间就出来了

一句话记牢:模型降价从来不是慈善,它是在为下一阶段的用量铺路。

五、现在能做的三件事

第一,别急着为"更便宜"提前充值。 这轮降价有明确生效时间和时段规则,先看常用工具跑的是不是 Flash 系列。

第二,把重复劳动丢给 AI。 批量整理文档、每日固定汇报、成百上千条内容打标签——这些是这波降价最直接的受益场景,现在试,成本比上个月低一大截。

*(本文数据来自 DeepSeek 开放平台公告及公开媒体报道。降价涉及具体产品与时段规则,请以官方页面为准。)*

查看「AI大模型」更多内容 → · 返回首页