脑机网 脑机网LOGIC.WANG
ESC

通义千问把 2.4 万亿参数的旗舰模型开源了,这意味着什么?

过去,最强大的大模型往往锁在闭源 API 背后,按次收费、越用越贵。阿里最新一次开源,把参数规模做到 2.4 万亿的旗舰级模型直接放了出来——这件事的分量,远不止"模型又大了一点"。

2026-09-29 · 1159 字 · 脑机网

过去,最强大的大模型往往锁在闭源 API 背后,按次收费、越用越贵。阿里最新一次开源,把参数规模做到 2.4 万亿的旗舰级模型直接放了出来——这件事的分量,远不止"模型又大了一点"。

一、这次开源的到底是什么

2026 年 8 月 3 日,阿里巴巴发布新一代基座大模型 Qwen3.8:总参数量 2.4 万亿,采用稀疏 MoE 架构,单次推理只激活约 950 亿参数,上下文窗口最长 100 万 tokens。最值得注意的是,这一次它首次把"Max 级别"的权重也开源了——开源版本名为 Qwen3.8-2.4T-A95B,与闭源旗舰同宗。同期还开源了 Qwen3.8-27B(270 亿参数的原生多模态稠密模型,支持 262K 原生上下文)。

换句话说,以往只有付费调用才能用上的"天花板"能力,现在任何人都能下载到自己机器上跑。

二、能力到了什么水平

据阿里云官方模型文档公布的基准,Qwen3.8-2.4T-A95B 在多个权威评测上表现靠前:GPQA Diamond 92.6、PaperBench 93.0、OSWorld 86.1、BabyVision 82.0,CodeArena 全球第 4。它最被看重的突破是"自主编程":官方演示中,模型连续运行约 16 天,从一个空文件夹出发,独立交付了一个可自进化的智能体框架项目,全程无需人工干预,代码与过程都开源在 GitHub 上。

以视觉理解为例,Qwen3.8 能读懂 200 页的财报 PDF、看懂超过 100 小时的长视频,并把"所见"直接反馈到工作流程里。

价格端也有信号:国内 API 每百万 tokens 输入 12 元、输出 36 元,约为同级别海外闭源模型的几分之一。相比只开放"缩水版"的做法,这次连 Max 级别的全量权重都放出来,等于把过去要花钱才能调用的天花板能力,一次性交到了开发者手里。

三、开源路线的真正信号

Qwen3.8 开源的范式意义,在于把"最强模型"从订阅制里释放出来。对中国企业而言,这意味着可以本地私有化部署:数据不出内网、长期成本可控、还能按自身业务微调。从 Qwen3.5 到 3.8,阿里这条"全场景模型矩阵 + 开放权重"的路线,已经让 Qwen 成为不少国产软硬件平台主动适配的对象——开源带来的不是"免费",而是部署自由度和生态粘性。

普通人现在能做什么

第一,开发者直接上手。 去 Hugging Face 或魔搭 ModelScope 下载 Qwen3.8 权重,用消费级显卡就能跑 27B 这类版本,搭私有知识库、客服机器人,不必长期付 API 订阅费。

第二,企业重估成本结构。 数据敏感、调用量大的团队,可以认真评估用开源旗舰替代闭源高价 API:一次性部署投入,摊薄后往往比按量计费划算,且数据主权留在自己手里。

第三,学习者低成本练手。 用 Qwen 配合开源工具链练智能体、练编程、练多模态理解,试错成本极低。对想入行的人来说,这代开源模型是难得的"免费练功房"。

查看「AI大模型」更多内容 → · 返回首页