脑机网 脑机网LOGIC.WANG
ESC

大模型又便宜了四成,为什么你的账单没降?

你有没有发现一件怪事:新闻里天天说大模型降价,可你自己掏的钱、公司报的账,好像一点没少。

2026-09-27 · 1062 字 · 脑机网

你有没有发现一件怪事:新闻里天天说大模型降价,可你自己掏的钱、公司报的账,好像一点没少。

上周又来了两轮。一边是 Anthropic 发布 Claude Opus 5.5,一边是 OpenAI 同步下调 GPT-6 系列的价格。两家隔着一天动手,像约好了一样。

这次降的到底是什么

Anthropic 的官方博客写得很直白:Opus 5.5 的输入价格是每百万 token 4 美元,输出是 20 美元,两项都比上一代 Opus 5 低两成;缓存读取从 0.5 美元砍到 0.2 美元,降幅六成。

但它没有把话说满。官方自己标注:所谓"比 Opus 5 便宜约四成",是一个针对典型工作负载的估算,前提是"新模型在完成同一件任务时用的 token 更少",而不是 token 单价又降了四成。

这句话里藏着关键。降价分成两半:一半是明码标价的单价下调,另一半是模型变"话少"了——它替你省掉的是废话,不是单价。

便宜的钱,被谁吃掉了

第一个吃掉它的是用量。单价降了两成,可如果任务量翻了一倍,总账还是涨的。模型越便宜,试用的人越多、跑的任务越长,这是行业里反复出现的现象。

第二个是缓存。Opus 5.5 把缓存读的价格降到五分之一,这对长期挂着跑的编程代理类任务影响最大。一场长会话里,大部分输入其实是在反复读缓存。官方给了一张示例账单:同样的 token 数下,光价格变化就让总成本降了约三成。

但如果你的用法是"问一句、答一大段",没有缓存、输出又长,那能省的就只有两成左右。省多少,取决于你的活长什么样。

能力这一侧也变了

Anthropic 同时给了一组测试数字。在 Terminal-Bench 4.0 这个专门考命令行实战的测试里,Opus 5.5 拿到 66.4%,上一代 Opus 5 是 52.3%。官方还提到一个案例:有测试者用它审计并修复了一个 20 万行的代码库,耗时不到三小时。

同一天的另一侧是 OpenAI 下调 GPT-6 系列价格。两家在几天之内各自发布更便宜、更强的模型,每一次都在重新定义"一块钱能买到多少算力"。

对买方来说,眼下确实是个少有的好位置:模型在变强,价格在变低。真正的风险不是买贵了,而是刚把系统绑死在某个模型上,下一轮降价就来了。

普通人现在能做什么

一,别急着签长约。如果公司正在选模型供应商,把"可替换"写进方案里——用统一接口调用,别把业务逻辑焊死在某一家身上。

二,算总账,不算单价。月底统计一下自己或团队的 token 消耗结构:是缓存读多,还是长输出多。搞清结构,才知道哪一轮降价真正落到你头上。

三,把省下的钱花在试错上。单价降了,就该多跑几次以前"舍不得跑"的实验。这才是降价对你的真实意义。

查看「AI大模型」更多内容 → · 返回首页