7月9日,OpenAI用一场"三连发"把大模型竞赛的桌子掀了。GPT-5.6系列一口气推出Sol、Terra、Luna三款模型,覆盖旗舰、均衡、轻量三个档位;同一天,ChatGPT Work智能体上线,把Codex、文件处理、网页操作缝合进一个工作台。这不是简单的版本迭代,而是AI从"聊天工具"向"生产力操作系统"的跃迁。
GPT-5.6 Sol搭载全新的Ultra多智能体模式,在Cerebras硬件上推理速度跑到每秒750 token,编码、生物学、网络安全等基准被集体刷新。定价上,Sol每百万token输入5美元、输出30美元,是三档里最贵的;Terra性能追平上代却价格砍半,主攻企业批量场景;Luna主打低延迟,服务高频轻量需求。与此同时,ChatGPT Work让模型自主拆解任务、调动子智能体并行处理,一个软件工程需求从写码到测试到部署一气呵成。
分层定价正在改写行业账本。每百万token约等于150万字中文内容,开发者第一次可以像买云资源一样按场景选模型。Anthropic的Claude Fable 5也同步把订阅期回血7天,OpenAI则取消Codex的5小时封顶——头部平台在"以价换量"上达成默契。同一周,谷歌确认Gemini 3.5 Pro将于7月17日发布,主打2M上下文与深度思考;DeepSeek V4正式版引入"峰谷定价",高峰时段价格翻番;马斯克的Grok 4.5也开放公众权限,对标Opus级。
这场混战的核心不再是跑分高低,而是API定价、推理速度和生态绑定的实打实较量。当模型能力逼近天花板,谁能把单位智能的成本压到最低,谁就握住了下一波AI应用的入口。ChatGPT Work的出现,意味着OpenAI不想只做"模型供应商",而是要吃掉整个工作流。
大模型的终局不是更大的模型,而是更便宜、更嵌入业务的智能体。GPT-5.6的三档分层,吹响了"超级应用"时代的前奏。
对开发者而言,7月的牌桌已经洗牌:与其追逐最强模型,不如想清楚你的场景该用哪一档。
2026.07.14