脑机网 脑机网LOGIC.WANG
ESC

GPT-5.6三档齐发、Grok 4.5同台,7月大模型上演"一周一旗舰"

2026年的7月,大模型发布节奏快到让人喘不过气。OpenAI、xAI、Anthropic、Meta、Thinking Machines、月之暗面、深度求索……

2026-07-20 · 1277 字 · 脑机网

2026年的7月,大模型发布节奏快到让人喘不过气。OpenAI、xAI、Anthropic、Meta、Thinking Machines、月之暗面、深度求索……几乎每隔几天就有一家头部实验室甩出新模型。行业里开始流传一个说法:现在是"一周一旗舰"的军备竞赛,慢半拍就可能被历史甩下。

这场混战的密集程度前所未有。7月9日,OpenAI宣布GPT-5.6正式GA(全面可用),一口气推出Sol、Terra、Luna三个档位;就在前一天,7月8日,xAI的Grok 4.5已经抢先登陆API,给出50万token上下文窗口。7月1日,Anthropic的Claude Sonnet 5与恢复供应的Fable 5同日上线。7月9日,Meta的Muse Spark 1.1成为其首个付费模型。

如果把视线再拉宽,国产阵营同样热闹。7月15日,Thinking Machines发布Inkling——一个975B参数、41B激活的MoE模型,直接以Apache 2.0协议开源,成为该参数规模下最宽松的许可;7月16日,月之暗面的Kimi K3发布;深度求索的DeepSeek-V4以MoE-2.0架构、2.4万亿总参数、360亿激活参数全面开源,推理成本仅为同行的十五分之一。

分层定价成为新主流

一个明显的变化是,模型厂商不再只拼"谁最聪明",而是把产品拆成梯次。OpenAI的Sol主打旗舰智能,Terra面向日常办公,Luna负责最快、最低成本。xAI的Grok 4.5给出明确的2/6美元每百万token报价。Claude Sonnet 5把上下文拉到100万token、最大输出翻倍到128K,定价还比上一代更友好。

长上下文几乎成了标配。GPT-5.6三档均有105万token上下文,Claude Sonnet 5与Kimi K3均突破百万。当模型能一口气读完一整本财报或代码仓库,"长文本处理"不再是卖点,而是入场券。

真正的分水岭,是开源阵营的集体壮大。Inkling、DeepSeek-V4、Kimi K3、美团的LongCat-2.0,让"闭源更先进"的叙事第一次被动摇。

竞争主轴的迁移

回头看,这场7月混战的背后,是竞争主轴从"能力上限"向"性价比与开放度"的迁移。当各家旗舰在主流基准上差距缩到几个百分点,用户更关心的是:每百万token多少钱、上下文够不够长、能不能私有部署。

开源模型的崛起尤其值得关注。Inkling以Apache 2.0这种近乎"随便用"的协议释出,意味着企业可以零顾虑地把975B参数模型塞进自己的机房。DeepSeek-V4则把推理成本压到极致,用十五分之一的价格逼近前沿性能。

下半年,战火烧得更旺。市场已经在押注OpenAI的GPT-6将于2026年下半年登场,Google的Gemini 3.5 Pro也已列入"即将发布"。可以预见,2026年的后几个月,大模型不会给任何人喘息的机会。

对从业者来说,这既是红利也是焦虑:模型选择空前丰富,但"选错模型"的代价也在变大。毕竟,在一个每六周就迭代一次的赛道里,今天的旗舰,可能只是下个月的基线。

2026.07.20

查看「AI大模型」更多内容 → · 返回首页