華為AI晶片集群「昇騰950超節點」亮相 與Nvidia別苗頭
華為在2026 WAIC展示昇騰950超節點真機,強調以超節點與集群補足晶片差距;同場多家中國廠商也推出大型AI集群方案,顯示產業競爭已轉向系統級算力。AI摘要
文章摘要整理:
在2026世界人工智慧大會(WAIC)上,中國多家廠商不約而同將展示重點放在智算集群和超節點上。其中,華為首次展示支持1024張神經網路處理器(NPU)高速互聯的昇騰950超節點(Atlas 950 SuperPoD)真機,並披露去年發布的昇騰384超節點已累計規模商用超過750套。
真機亮相通常代表產品已經跨越實驗室驗證階段,在高速互聯、散熱設計、系統穩定性等工程能力上具備規模交付條件。
而中興通訊則聯合壁仞科技、沐曦股份、燧原科技等多家中國國產GPU企業,打造國產高性能Matrix超節點。中科曙光則首發scaleX 10萬卡超智融合集群系統,這也是中國規模最大的AI4S(科學智慧)計算集群。不同廠商採用不同技術路線,但共同指向一個趨勢,中國國產AI算力正從單晶片競爭邁向系統級集群能力競爭。
去年9月,華為輪值董事長徐直軍發布昇騰晶片的演進和目標。他表示,未來三年,華為已經規畫了昇騰多款晶片,包括950PR、950DT以及昇騰960和970。
其中,昇騰950系列按照不同訓練和推理場景畫分為950PR和950DT兩個型號,如今,Atlas 950 SuperPoD亮相,正是這一產品路線圖的落地。
由於受限於先進製程的獲取,華為單顆昇騰晶片的算力目前還難以直接與Nvidia(輝達,另譯英偉達)晶片競爭,但華為以量取勝,透過「超節點+集群」的算力解決方案,滿足持續增長的算力需求。
超節點,是將數百至數千顆AI晶片高效互聯,形成物理上多機組成、邏輯上單機運行的超級計算單元,實現記憶體統一編址,解決大模型訓練中的「通信牆」瓶頸,大幅提升AI訓練推理效率。
透過資源的高效調度,超節點在一定程度上可以彌補晶片工藝的差距。以Atlas 950 SuperPoD為例,以單櫃64卡為基本單元,支持1,024張NPU卡高速互聯,並實現256TB統一記憶體編址。
不過集群也面臨能耗高、占地面積大等問題。徐直軍去年就表示,只有依靠超節點和集群,才能持續為中國AI提供充裕算力。
值得注意的是,華為並不是少數押注超節點的企業。國外有輝達推出GB200 NVL72(72顆GPU),並計畫進一步推出NVL144,透過NVLink Switch將更多GPU組成統一計算域;Meta宣布建設Prometheus和Hyperion兩座超大規模AI資料中心,目標部署數10萬張GPU。
此外,中國的阿里、字節、騰訊、百度、中科曙光、浪潮信息、新華三等多家廠商也均推出超節點方案。
華為首次展示昇騰950超節點(Atlas 950 SuperPoD)真機,可支援1024張NPU高速互聯,並實現256TB統一記憶體編址,代表其產品已進入可規模交付階段。 因為各家廠商不再只比單顆晶片效能,而是改以超節點、超節點集群與大規模互聯能力競爭,重點在提升大模型訓練與推理的整體效率。 華為以「超節點+集群」策略提升總算力,透過大量NPU高效互聯與統一編址降低通信瓶頸,用系統整合能力彌補單晶片工藝落差,滿足持續增加的AI需求。精華 FAQ
