脑机网 脑机网LOGIC.WANG
ESC

国产大模型三箭齐发:Qwen3.8、DeepSeek V4-Flash、MiniMax H3同日亮剑

8月3日,中国AI大模型赛道迎来一次罕见的“超级星期一”。阿里巴巴发布2.4万亿参数旗舰模型Qwen3.8-Max,上下文窗口长达100万tokens;Deep

2026-08-04 · 1318 字 · 脑机网

8月3日,中国AI大模型赛道迎来一次罕见的“超级星期一”。阿里巴巴发布2.4万亿参数旗舰模型Qwen3.8-Max,上下文窗口长达100万tokens;DeepSeek-V4-Flash正式版API公测并登顶OpenRouter单模型调用量榜首;MiniMax开源通用视频模型H3,意图在多模态领域复刻DeepSeek效应。

三家不同路线的公司,同一天把战火引向同一个方向:开源、Agent、多模态。这不是参数内卷,而是中国大模型从“秀肌肉”走向“拼落地”的关键转折。

一、Qwen3.8-Max:阿里把旗舰模型重新定价

Qwen3.8-Max采用MoE架构,总参数2.4万亿,单次推理仅激活950亿参数。在Coding和专业办公场景能力大幅提升,Vision Arena排名全球第二,模型权重将于下周开源。

对创业者和AI工作室来说,这意味着顶级多模态能力不再依赖闭源API。企业可以在本地部署、结合自身数据微调,满足安全合规要求。阿里云AI收入已连续11个季度三位数增长,预计年底ARR将达300亿元。阿里的逻辑很清晰:用开源模型扩大生态,用云服务兑现商业化。

二、DeepSeek V4-Flash:性价比“斩杀线”划到全球

DeepSeek-V4-Flash登顶OpenRouter单模型调用量第一,输入1元/百万tokens、缓存命中低至0.02元/百万tokens。海外开发者因推理成本下降60%—85%大规模迁移。

低价背后是工程能力的极致体现。DeepSeek通过后训练优化,在9项Agent基准测试中全面超越预览版,DeepSWE编码测试分数从7.3分飙升至54.4分,增长超6倍。对AI副业和AI工作室来说,调用成本下降直接意味着利润空间扩大。

三、MiniMax H3:视频模型进入商业级生产

MiniMax H3通过高压缩Tokenizer降低视频生成所需Token数量,实现成本优化与效率提升,并将于未来几天内开源。

这释放了一个信号:多模态竞争已从“能不能生成好看视频”,转向“能不能以可控成本批量生产商业内容”。AIGC沙龙里常被问到一个问题:AI视频到底能不能赚钱?MiniMax H3的答案是可以,但前提是成本足够低、可控性足够强。

四、对从业者的三点启发

第一,开源模型正在重塑AI创业门槛。过去需要几千万融资才能做的垂直模型,现在一个人、几台卡、一个开源基座就能启动。

第二,Agent是下一个Token消耗确定性方向。阿里“千问办公”、腾讯WorkBuddy、字节Trae都在争夺Work Agent入口。AI工作室可以把Agent封装成SaaS服务,卖给中小企业的具体岗位。

第三,调用量连续十四周全球第一的中国大模型,正在从“便宜好用”走向“定义标准”。

核心观点:大模型下半场的胜负手,不再是参数量,而是谁能把模型能力变成可规模化的商业系统。中国玩家的优势,正从成本领先转向生态定义。

当Qwen3.8、DeepSeek V4-Flash、MiniMax H3在同一天发布,大模型正式进入“开源+Agent+多模态”的三位一体时代。对创业者来说,最好的入场时机,从来都不是等风停,而是在风最大的时候先跑起来。

脑机派对 · 2026.08.04

查看「AI大模型」更多内容 → · 返回首页