脑机网 脑机网LOGIC.WANG
ESC

CUDA铁幕裂开!DeepSeek V4全面换装华为昇腾,H20解禁背后的芯片暗战

7月15日,英伟达宣布H20芯片恢复对华销售,AMD的MI308也紧随其后获得审核放行。表面上看,这是中美芯片博弈的一次"缓和信号"。但几乎同一时间,一个更深层

2026-07-16 · 1176 字 · 脑机网

7月15日,英伟达宣布H20芯片恢复对华销售,AMD的MI308也紧随其后获得审核放行。表面上看,这是中美芯片博弈的一次"缓和信号"。但几乎同一时间,一个更深层的变局正在发生——DeepSeek最新的V4模型宣布完全运行在华为昇腾芯片上,成为全球首个完全不依赖英伟达GPU的万亿参数大模型。CUDA的护城河,正在被从内部攻破。

黄仁勋7月16日在链博会上穿唐装、说中文,高度评价DeepSeek"是全球第一个开源推理模型,毫无疑问的突破"。但鲜为人知的是,这个被他盛赞的中国团队,已经用行动给出了另一种答案:不靠英伟达,一样能跑万亿参数。

H20解禁:90万库存对180万需求

英伟达H20恢复对华销售,表面利好,实则暗藏尴尬。据杰富瑞估算,英伟达目前H20库存约60万至90万颗,而中国市场需求约180万颗——缺口近一倍。更关键的是,H20是Hopper架构的末端产品,性能大幅缩水,仅适用于推理和中等规模训练,无法满足万亿参数模型的训练需求。

国信证券研报指出,H20恢复供应将带动国内云厂资本开支上升,但国产芯片在二季度的买租占比已显著提升。禁售三个月期间,国内AI行业并未停摆,反而加速了国产替代进程。

DeepSeek V4:万亿参数跑在昇腾上

DeepSeek V4是一个万亿参数的混合专家模型,每次推理激活约370亿参数,支持多模态输入。这个体量的模型此前几乎都跑在英伟达GPU上。DeepSeek是第一个把旗舰级AI模型完整迁移到国产芯片上的团队——硬件基础是华为昇腾910C(7nm工艺,FP16算力800 TFLOPS)和即将量产的昇腾950PR(FP4算力2 PFLOPS)。

这不是简单的"能用就行"。DeepSeek针对昇腾架构重新设计了模型运行方式,让R1模型充分发挥H20架构的优势——这种从底层硬件到模型架构的协同优化,恰恰是黄仁勋口中"真正的创新"。

国产替代加速:46%预算转向本土芯片

彭博行业研究7月发布的调研显示,覆盖金融、互联网、高端制造、政企算力四大领域60家头部企业中,未来12个月国内企业46%的AI芯片采购预算将投向本土厂商——目前这一比例仅为30%,意味着国产芯片采购规模即将翻倍。

IDC数据显示,去年国内数据中心加速卡市场中国产算力占比34.6%,预计今年上半年已超四成。华为CloudMatrix 384超节点用384张昇腾芯片实现业界最大规模高速总线互联,FP16吞吐量比英伟达NVL72高约40%。

核心观点:自主可控不可逆转

H20的"去而复返"更像是一场末代狂欢。对国内从业者而言,与其纠结一款产品的进出,不如聚焦核心技术突破。禁售期间,中国AI产业证明了一件事:没有英伟达,照样能做世界级的大模型。当DeepSeek V4跑在昇腾上的那一刻,CUDA的铁幕就已经裂开了——而这个裂缝,只会越来越大。

2026.07.16

查看「算力芯片」更多内容 → · 返回首页