
华为昇腾910C被抢光:字节阿里扫空库存,中国AI算力的命门不在华盛顿
作者 | 佳明
编辑 | 陈立峰
八月中旬,几家头部大模型公司的采购负责人私下都在忙同一件事,托关系、加预算、甚至提前预付,只为多抢到几千张华为昇腾910C。
这款一年前还被质疑能不能用的国产训练芯片,如今在现货市场一卡难求,二级市场一度被炒出三成以上的溢价。
字节和阿里已经把现有库存扫光,腾讯、百度、科大讯飞在后面排队等着分货。
一个耐人寻味的转折出现了,所有人此前都以为国产算力最大的敌人是华盛顿的制裁,现在看,真正的瓶颈可能是华为自家工厂那道始终爬不上去的良率。
时间回到2022年,英伟达为了绕过管制推出降规版的A800和H800,靠砍掉互联带宽勉强留在中国市场。
到了2023年10月,这两款也被纳入禁售清单,英伟达这才推出性能更弱的H20特供版。
转折发生在2025年下半年,美国商务部先是暂停H20对华销售,又在恢复出口后立刻被网信办以漏洞后门安全风险约谈英伟达。
H200虽然获批,却附带苛刻的转运审查条件,实际采购几乎为零,特供芯片的神话就此破灭。
国产替代的这股叙事,就这样被一把火彻底点燃了。
到了2026年一季度,英伟达在中国加速卡市场的份额急剧萎缩,国产芯片已实现反超,其中华为昇腾占据领先地位。
就在这个被硬生生腾出来的空窗期,华为昇腾成了最确定的那一个选项。
910C在2025年全年出货约八十一点二万颗,拿下国内近一半份额,2026年一季度又交付15万张,服务了37家头部大模型企业。
华为应对制裁的法子很特别,徐直军把它称作超节点加集群,本质是用系统能力去补单芯片的短板。
任正非此前更早点破过,华为这套应对,本质是用数学去补物理的短板,这非常考验通信和散热的硬功夫。
单颗昇腾芯片的性能大约只有英伟达GB200的三分之一,但华为把384颗910C塞进一个CloudMatrix 384超节点,整体BF16性能反而是GB200 NVL72的一点七倍,内存容量是它的三点六倍,带宽是其二点一倍。
研究机构SemiAnalysis算过一笔账,这个超节点靠堆叠数量和高速互联,硬是把单卡劣势抹平了。
代价是功耗据称约为NVL72系统的数倍,有报道称约4倍,不过华为副总裁李俊风说,电力问题并不是中国面临的限制因素。
故事一旦讲到华为这家公司身上,就该出现戏剧性的反转了。
910C用的是中芯国际第二代7纳米工艺,2025年初良率才爬到40%,至今仍是产能的天花板。
晶体管集成约530亿颗,全靠Chiplet封装把两颗910B拼在一起。
比良率更麻烦的一件事,是那块怎么也绕不开的高带宽内存。
910C要配128GB HBM,这部分长期依赖外部供应,加上二点五D先进封装的瓶颈,月产能爬坡面临挑战,具体数字因统计口径不同而存在差异,据行业普遍估计,仍处于数千颗级别。
2026年下半年的这场供给荒,根子就埋在这一环上。
字节和阿里把库存扫光之后,排在后面的公司只能干等。
即便华为把全年整体出货目标定在150万到200万颗,要拿下国内近一半市场,以当下的爬坡速度,未必能填满互联网大厂张开的胃口。
徐直军这个人,在过去几年里只要聊到芯片就异常低调。
他在2025年9月群访时感慨:“从2020年开始一直到去年啥都不敢讲,但也不能老憋着,所以今年就秀了点肌肉。”
把互联带宽和算力参数悉数摊开。
这种突然高调起来的转变,背后靠的是实打实的底气。
华为在2025全联接大会上首次公布三年芯片路线图,从910C一路排到970,徐直军判断,单颗芯片和英伟达有差距,做成超节点和集群,华为有自信。
一个细节值得玩味,华为甚至不惮于直接叫板英伟达。
徐直军拿Atlas 950超节点对比英伟达NVL144,卡的规模是它的56.8倍,总算力是它的6.7倍,内存容量是它的15倍,还宣布开放自研的灵衢互联协议。
尽管早期市场对国产芯片的接受度曾存有疑虑,但真正让互联网大厂动心的,是2026年3月发布的昇腾950PR。
这款推理芯片单卡算力达到英伟达H20的二点八七倍,价格却只有对方的四分之一左右,搭载112GB自研HBM,对CUDA核心接口的兼容超过九成。
950PR在2026年6月订单环比增长近10倍,字节、腾讯、阿里已经采购,全年出货目标75万片。
它专攻推理预填充和推荐场景,处理70B参数大模型单卡只需35GB显存,多模态生成速度提升约六成。
黄仁勋曾公开说,低估华为这样的竞争对手是愚蠢的。
这句话放在950PR身上格外贴切,用不到对手一半的价钱,干掉了对方在中国市场仅存的性价比防线,难怪深度求索4月就宣布基于它开发并开源模型。
把视线拉高一层,昇腾的供给荒其实戳破了一个幻觉。
很多人以为只要国产芯片能造出来,算力主权就握在自己手里。
现实是,芯片的命门在上游,中芯国际的良率和HBM的库存才是真关卡。
美国对华芯片禁令已经是常态化,从地域管制转向主体穿透,连第三国绕道都被盯死。
高端芯片引进之路基本被焊死,这反而逼出了华为的超节点路线,也逼出了国产供应链的集体补课,先进制程最艰难的阶段或许已经过去。
目前来看,国产7纳米产线在禁运设备上已有国产方案填补约三成空白,但整体仍落后。
华为这一套路数能不能扛住长期需求,恐怕还要看良率和封装的释放节奏,各家分析师对真实产能的估算也并不统一。
深圳河套学院在2026年6月干了一件标志性大事,联合哈工大深圳和深圳市大数据研究院,用910C集群完成了一点六万亿参数DeepSeek模型的全程后训练。
这件事证明国产算力能扛住顶级训练,却也把产能的稀缺性摆上了台面。
科大讯飞董事长刘庆峰私下算过一笔账,为了在国产算力上训练模型,团队额外花了两个月做适配,代价不只是钱,更是被拖慢的发布节奏。
当连最基础的模型适配都要排队等卡,真正的瓶颈早就不在算法那一头了。
真正的风险这一环,反倒很少有玩家愿意把它摊开来讲。
百度智能云首席科学家王雁鹏在某次论坛上点出,国产芯片故障率被放大,集群还可能出现毫无报错的静默故障,一旦定位不到出问题的卡,整个训练就可能前功尽弃。
华为并不是没意识到这点,CloudMatrix 384超节点在两三年前就开始规划,今年才顺利推出。
但950PR能否如期放量,目前来看仍存疑,各方的出货目标和真实良率数据常常对不上,市场情绪难免被预期牵着走。
寒武纪的思元590、海光的DCU也在分这块蛋糕,国产阵营整体把英伟达挤到了三成多份额。
可问题在于,除了华为昇腾,真正能跑大模型训练的国产芯片少之又少,供给的集中度反而更高了。
算一笔最直接的商业账,910C单卡市场价据行业估算在数万至十余万元区间,一台Atlas 900 A3超节点装满384颗芯片,政府采购整体价格亦高达数千万元级别,具体成交价因采购规模而异。
粤港澳大湾区的万卡智算集群一次就部署了一万一千五百二十张910C,这种采购规模放在两年前根本不敢想。
华为敢把价格压到英伟达特供版以下,靠的是不用付那笔隐含的断供风险溢价。
可反过来看,当大厂愿意为国产算力付出现金流,华为的产能却被卡在良率上,这笔账的两边并不平衡,卖方市场的姿态恐怕维持不了太久。
把镜头摇到任正非身上,这位八十多岁的创始人早在制裁之初就定调:“华为要用数学去补物理的短板。”
这句话当时被不少人当成无奈的安慰,如今看,它更像一份写给人看的作战说明书,联接技术三十多年的家底全押在了这一局。
华为把超节点技术还引入了通用计算,发布泰山950超节点搭配GaussDB,目标直指大型机和小型机的替代。
徐直军放话,这套组合要成为各类大型机的终结者,国产替代从AI算力一路烧到了核心数据库。
站在全球视角看,华为已经成了英伟达必须正眼瞧的对手。
黄仁勋不止一次在公开场合提到华为,直言低估这样的竞争对手是愚蠢的,英伟达在中国的市场份额从95%一路滑到可以忽略。
这场此消彼长,靠的不是某颗芯片的单项胜出,而是整套国产体系的接力。
可当接力棒真正传到华为手里的那一刻,重量并不轻。
当BAT和字节把订单堆过来,华为要同时应付良率、内存、封装三道关口,任何一道卡住,承诺的出货量就会打折。
市场现在给华为的耐心有限,毕竟训练任务等不起,谁先供得上卡,谁才握得住客户。
写到了收尾的地方,还是想替整个行业说一句实在的大白话。
华为昇腾这一轮被抢光,说明国产算力已经过了能不能用的阶段,正在撞上供不供得上的阶段。
制裁把市场硬塞给华为,但工厂和供应链未必接得住这份厚礼。
中国AI接下来要补的课,不在华盛顿,在良率、在内存、在那条还烫手的量产线上。
华为用超节点补出了单芯片的差距,却补不出一夜之间就能爬坡的工厂,这才是这场抢芯片荒留给所有人最实在的提醒。
当潮水退去,真正能决定胜负手的,从来不是谁喊的口号更响,而是谁先把那道良率的坎迈过去。





京公网安备 11011402013531号