脑机网 脑机网LOGIC.WANG
ESC

模型输出提速五成、万亿参数大模型打折上新:这次卷的不是聪明,是"快"和"便宜"?

你有没有发现,最近评价AI模型的新闻,关键词悄悄变了?以前是"跑分第一""登顶榜单",现在频繁出现的是另外两个词:速度,价格。

2026-10-07 · 1009 字 · 脑机网

你有没有发现,最近评价AI模型的新闻,关键词悄悄变了?以前是"跑分第一""登顶榜单",现在频繁出现的是另外两个词:速度,价格。

最近一周的两条消息,把这种变化摆到了台面上。据海外AI资讯机构追踪,OpenAI将其两款主力模型的默认生成速度提升了约五成,优化后可达到每秒数十token的输出水平,且在短时间内完成了对全部订阅用户的推送。另一边,法国公司Mistral的旗舰多模态模型以"万亿参数、激活仅数百亿"的架构上线第三方平台,并以限时五折的价格策略吸引开发者迁移。

一、为什么"快"突然变得这么重要

答案藏在使用方式的变化里。过去用AI主要是"提问—等待—读答案",几十秒的等待可以忍受。现在流行的用法是AI智能体连续执行任务:写代码、订行程、批量处理文档,一个任务动辄几十轮调用。每一轮快一秒,整个任务就快一分钟;一天处理上千个任务的企业,速度就是真金白银的运营成本。

同样的逻辑适用于价格。智能体工作流的token消耗是聊天场景的百倍量级,输出单价降一点,月账单的差别就是几万块。这也是为什么各家厂商不约而同地在"每百万token单价"上做文章。

二、一个更值得注意的新物种:会做决定的"小模型"

这轮上新潮里,还有个容易被忽略的趋势:一批专门帮AI"做决定"的小模型悄然上线。有云厂商和搜索公司先后推出了所谓"决策模型"——它们不聊天、不写诗,只回答结构化问题:"这个选项选不选?""这个评分给几分?",并且以毫秒级速度返回带置信度的结果。

这像极了职场里的分工:大模型是能啃硬骨头的专家,决策小模型是流水线上的质检员。智能体每走一步要做的海量琐碎判断,交给小而快的模型,成本骤降。这个"大小搭配"的架构,可能成为下一代AI产品的标配。

三、对普通用户的三层影响

  • 你常用的AI助手会明显变快,长回答不再"一个字一个字往外蹦";
  • 订阅价格可能更友好,头部厂商的价格战最终会传导到消费端;
  • 高级功能加速下放,原来旗舰版才有的能力,会更快出现在免费或低价版本里。

四、普通人现在能做什么

  • 做自媒体、写代码、跑业务的,重新测一遍自己工作流里AI工具的响应速度,升级后的版本可能值得你重排流程;
  • 开发者可以把"输出单价、生成速度"列为选型的第一权重,跑分时代的选择标准该更新了;
  • 所有用户:遇到服务明显变快或变便宜,记得看看官方更新日志——那往往是模型底座升级的信号。

AI竞赛的下半场,赢家未必是最聪明的那一个,而可能是又快、又稳、又便宜的那一个。

查看「AI大模型」更多内容 → · 返回首页