華為發表昇騰 960 超節點:光互連省電,仍要等晶片與供貨跟上
重點摘要
華為公布 NPO 光互連與提前的 2027 年晶片時程,宣稱替換光模組可降低逾 550 千瓦功耗。系統仍在測試,產能也不足,架構改善須與實際交付分開判讀。
Huawei(華為)在 2026-09-17 發表採用近封裝光學(NPO)互連的昇騰 960 超節點,宣稱可降低逾 550 千瓦功耗。不過,公告沒有提供相同模型、相同精度下,每完成一次訓練耗多少電的比較。這個資料缺口限制了省電數字的用途:少用電的互連,有機會改善整套系統效率,還不能直接換算成模型訓練成本下降。華為公告
這是上海全聯接大會當天的新發表,本文也採台北 9 月 17 日出刊。官方頁面只列日期,沒有發布時刻;路透報導最初刊於台北 11:33,並於 17:07 更新,均早於本次 20:46 的查核截止時間。路透確認,華為把 960DT 排到 2027 年第一季、960PR 排到第三季,分別比原計畫提前三季與一季;這些仍是未來時程。路透報導
光引擎減少連接大量晶片的負擔
華為用 UnifiedBus 連接運算、記憶體與儲存元件,並提供統一記憶體定址。設計目的在於讓多顆處理器共同工作,降低跨設備交換資料的負擔。架構公告 新超節點可擴至 4096 卡,以 5500 個 Hi-ONE 光引擎替代原需的 48000 個 800G 光模組;逾 550 千瓦的減耗,是公司對這項替換提出的數字。華為公告
把資料送到正在運算的晶片,需要連接設備,也需要電。華為嘗試從這部分減少投入,讓擴充系統時不必按原方式增加同樣多的光模組。我看好這個設計方向,因為它處理的是多顆晶片一起工作時的負擔;但連接得更省,能替哪一種模型省下多少成本,仍取決於那項工作有多少時間花在資料交換,以及新設備的售價。
華為另一份當日公告把交付狀態寫得更清楚:採 NPO 的 Atlas 960 系統仍在測試;正在部署的 256000 卡超叢集,屬於上一代 Atlas 950。這提供了大規模部署的具體案例,卻沒有公開客戶名稱與驗收結果,也不能把上一代的部署數量當成新系統已出貨。架構公告
提前的晶片時程,尚未解除供應限制
路透引述輪值董事長徐直軍表示,華為的 AI 運算設備產能連中國需求都未能滿足,因此暫不全面拓展海外市場,僅有有限供貨。報導也指出,公司沒有提出資料支持其昇騰在中國市占高於 NVIDIA 的估計。路透報導 新架構已公布,買方能取得多少設備,仍是另一項限制。
這使我更傾向把本次發表看成算力如何協同工作的改善,而不急著推算它會取代多少競爭對手。假設一家模型業者已經受供電額度限制,降低互連耗電可能讓同樣的電力容納更多有效運算;若它等的是尚未交付的晶片,光引擎再有效率,也無法先補出那批產能。兩種情況需要的解法不同。
對產品成本的判斷,也應沿著這個差別往下算。只有在相同模型與精度下,連同等待、重試及散熱計入的總耗電下降,省電才足以支持更低的運算成本;若新增硬體費用抵消節省,服務價格仍未必降低。這是依公告提出的比較方式,目前來源沒有完整測試條件或報價,無法替它填入回報數字。
等 Atlas 960 完成測試並交付後,我會看固定工作量的總耗電與完成時間,再對照買方實際拿到的設備數量。前者能檢驗光互連有沒有改善工作效率,後者才能說明新時程增加了多少可用算力。
封面沿用本站華為 HarmonyOS 7 發表資料圖,非本次昇騰 960 實物或大會現場;本次官方照片下載失敗。
來源: