---
title: "CUDA铁幕裂开！DeepSeek V4全面换装华为昇腾，H20解禁背后的芯片暗战"
date: 2026-07-16
category: 算力芯片
site: 脑机网
canonical: https://aiai.cafe/a/njw-90eae6
language: zh-CN
---

# CUDA铁幕裂开！DeepSeek V4全面换装华为昇腾，H20解禁背后的芯片暗战

> 7月15日，英伟达宣布H20芯片恢复对华销售，AMD的MI308也紧随其后获得审核放行。表面上看，这是中美芯片博弈的一次"缓和信号"。但几乎同一时间，一个更深层

7月15日，英伟达宣布H20芯片恢复对华销售，AMD的MI308也紧随其后获得审核放行。表面上看，这是中美芯片博弈的一次"缓和信号"。但几乎同一时间，一个更深层的变局正在发生——DeepSeek最新的V4模型宣布完全运行在华为昇腾芯片上，成为全球首个完全不依赖英伟达GPU的万亿参数大模型。CUDA的护城河，正在被从内部攻破。

黄仁勋7月16日在链博会上穿唐装、说中文，高度评价DeepSeek"是全球第一个开源推理模型，毫无疑问的突破"。但鲜为人知的是，这个被他盛赞的中国团队，已经用行动给出了另一种答案：不靠英伟达，一样能跑万亿参数。

H20解禁：90万库存对180万需求

英伟达H20恢复对华销售，表面利好，实则暗藏尴尬。据杰富瑞估算，英伟达目前H20库存约60万至90万颗，而中国市场需求约180万颗——缺口近一倍。更关键的是，H20是Hopper架构的末端产品，性能大幅缩水，仅适用于推理和中等规模训练，无法满足万亿参数模型的训练需求。

国信证券研报指出，H20恢复供应将带动国内云厂资本开支上升，但国产芯片在二季度的买租占比已显著提升。禁售三个月期间，国内AI行业并未停摆，反而加速了国产替代进程。

DeepSeek V4：万亿参数跑在昇腾上

DeepSeek V4是一个万亿参数的混合专家模型，每次推理激活约370亿参数，支持多模态输入。这个体量的模型此前几乎都跑在英伟达GPU上。DeepSeek是第一个把旗舰级AI模型完整迁移到国产芯片上的团队——硬件基础是华为昇腾910C（7nm工艺，FP16算力800 TFLOPS）和即将量产的昇腾950PR（FP4算力2 PFLOPS）。

这不是简单的"能用就行"。DeepSeek针对昇腾架构重新设计了模型运行方式，让R1模型充分发挥H20架构的优势——这种从底层硬件到模型架构的协同优化，恰恰是黄仁勋口中"真正的创新"。

国产替代加速：46%预算转向本土芯片

彭博行业研究7月发布的调研显示，覆盖金融、互联网、高端制造、政企算力四大领域60家头部企业中，未来12个月国内企业46%的AI芯片采购预算将投向本土厂商——目前这一比例仅为30%，意味着国产芯片采购规模即将翻倍。

IDC数据显示，去年国内数据中心加速卡市场中国产算力占比34.6%，预计今年上半年已超四成。华为CloudMatrix 384超节点用384张昇腾芯片实现业界最大规模高速总线互联，FP16吞吐量比英伟达NVL72高约40%。

核心观点：自主可控不可逆转

H20的"去而复返"更像是一场末代狂欢。对国内从业者而言，与其纠结一款产品的进出，不如聚焦核心技术突破。禁售期间，中国AI产业证明了一件事：没有英伟达，照样能做世界级的大模型。当DeepSeek V4跑在昇腾上的那一刻，CUDA的铁幕就已经裂开了——而这个裂缝，只会越来越大。

2026.07.16

---

来源：脑机网（https://aiai.cafe/）｜原文：https://aiai.cafe/a/njw-90eae6
本内容仅供参考，不构成投资建议。
