7月31日这一天,全球大模型版图被悄悄改写。一边是 OpenAI 把刚发布三周的 GPT-5.6 直接降价八成,像极了电商大促的"限时秒杀";另一边,中国大模型正在以肉眼可见的速度"上车、进厂、入终端"。这两条线在同一天交汇,释放出同一个信号:大模型竞争的主战场,已经从实验室跑分转移到真实场景的贴身肉搏。
最先引爆的是 DeepSeek。7月31日,深度求索宣布 DeepSeek-V4-Flash 正式版 API 上线公测,模型结构不变、仅做后训练优化,但 Agent 能力大幅跃升——Terminal Bench 2.1 冲到 82.7 分,DeepSWE 指标从 7.3 飙升至 54.4。更关键的是,它原生支持 OpenAI Responses API 格式,并针对 Codex 完成专项适配,开发者可以在 Codex CLI 和 VS Code 插件里直接调用。这意味着中国开源模型第一次在"编程智能体"这个最硬核的战场,拿到了和硅谷平起平坐的入场券。
同一天,特斯拉中国开始分批推送 2026.14.13 版本车机更新,首次在国内车机引入字节跳动豆包大模型作为智能语音助手,支持多音色和"万事通""故事会"等角色。更劲爆的是界面新闻披露:阿里千问已进入特斯拉中国车机深度测试,"能听能答、能控车、能导航、能办事",分工被形容为"豆包陪聊、千问办事"。虽然阿里云和特斯拉中国都未作正式回应,但"国产大模型上车特斯拉"已经从传言走向实锤。
特斯拉的入口之争尤其值得玩味。中国是特斯拉全球第二大市场,上千万存量车主背后是高频、刚需、强付费的车载场景。过去这个入口长期被海外语音方案占据,如今豆包和千问先后切入,意味着中国大模型第一次在"轮子上的操作系统"里拿到了默认席位。对阿里和字节而言,这不止是多一个 App 集成,而是把模型能力直接种进了用户的日常通勤。
压力给到了 OpenAI。7月30日生效的新一轮降价里,最便宜的 Luna 模型输入价格降至 0.2 美元/百万 token、输出 1.2 美元/百万 token,较此前直降 80%;Terra 模型也下调 20%。官方口径是"把轻量级推理成本压到极低",但明眼人都看得出,这是国产开源模型全球下载破百亿次、字节大模型 ARR 突破 40 亿美元之后,闭源巨头被迫接住的"价格战"。
这三件事拼起来,是一条清晰的逻辑链:国产大模型不再满足于"追平",而是开始"定义场景"。DeepSeek-V4 抢的是开发者心智,豆包和千问抢的是千万级车主的入口,而 OpenAI 的降价本质上是在用利润换时间。
真正的拐点在于——当模型能力差距收敛到"够用"的区间,竞争焦点就不再是"谁更聪明",而是"谁离用户更近"。车机、IDE、企业后台,这些过去被西方模型把持的入口,正在被中国模型逐一撬开。
对从业者来说,今天的一个动作值得立马做:拿你自己的业务数据,把 DeepSeek-V4-Flash 和 GPT-5.6 各跑一遍。别只看官方 benchmark,真实场景下的稳定性、成本和中文理解力,才是决定你站在哪一队的关键。大模型的反攻,已经从新闻变成了你的选择题。
脑机派对
2026.07.31 · AI前沿观察