share_log

首個採用NPO的昇騰960超節點來了!華爲新款AI芯片將提前推出

財聯社 ·  09/17 13:32

①汪濤宣佈昇騰960芯片研發進度超出預期,實現性能翻番。其中,昇騰960DT將於2027年Q1推出,比原計劃提前三個季度②華爲發佈業界首個採用NPO技術的昇騰960超節點,並升級鯤鵬超節點、推出OceanStor M900 AI記憶存儲系統。

《科創板日報》9月17日訊(記者 黃心怡)今日,華爲全聯接大會2026在上海啓幕。華爲發佈業界首個採用NPO技術的昇騰960超節點,並升級鯤鵬超節點、推出OceanStor M900 AI記憶存儲系統;基於靈衢UnifiedBus統一互聯,構建Agentic超節點集群,支持百萬卡超大規模集群。

《科創板日報》還從會上獲悉,截至目前,鯤鵬全球開發者超過了416萬,全球生態合作伙伴超過7200家,支持了560多個全球開源項目,openEuler裝機量也已超過2000萬套,成爲中國服務器操作系統第一份額。CANN社區月活開發者突破5200名,基於昇騰+CANN的原生訓練模型已超過40個,也是國內唯一支持預訓練的技術路線。

▍華爲AI戰略的核心是算力

華爲副董事長、輪值董事長汪濤表示,AI變革的速度超過歷史上任何一次技術革命。今天大模型參數已經快速邁向10萬億,到2030年將達到100萬億以上;智能體已經可以按小時級連續工作,到2030年將以月爲單位執行任務;中國每日推理Token已增長到每日500萬億左右,到2030年將達到百萬萬億級。端側智能也在快速增強,手機模型從2024年的3B發展到今天的30B,未來將進一步走向100B級。這些變化,都對AI基礎設施的規模、性能和可靠性提出了更高的要求,只有打造更加強大的AI基礎設施,才能築牢智能世界的堅實底座。

汪濤稱,華爲AI戰略的核心是算力,堅持硬件變現,圍繞「超節點+集群」,通過系統架構創新構建競爭力,打造中國堅實算力底座,爲世界構建新的選擇;堅持構建開源開放的算力生態,支持主流大模型基於昇騰原生訓練、積極擁抱「百模千態」;面向客戶,我們提供線下、線上的靈活算力方案,加速千行百業智能化;面向豐富的端側場景,通過提供大中小微多樣性算力,推進AI入端、上車,物聯輕智能升級,讓智能真正無所不及;圍繞「用算」構築新一代通信網絡,把智能傳遞給每個人、家庭和企業。

▍業界首個使用NPO的昇騰960超節點發布

截至目前,昇騰910C超節點已部署超1000套,昇騰950超節點也已規模商用。超節點是一種在物理上由多個計算節點通過高效的互聯協議緊密連接組成,具備跨物理節點統一內存編址能力,邏輯上具備「一臺計算機」特徵的計算系統。

汪濤表示,超節點已成爲建設超大規模AI基礎設施的必然選擇。當前,10萬卡集群已成爲訓練十萬億級SOTA模型的標配,但傳統服務器架構導致集群內通信超過訓練時間的40%,嚴重製約了MFU(模型浮點算力利用率)。根據華爲馬爾科夫實驗室仿真結果顯示,4K超節點組成的10萬卡集群相比由8卡服務器組成的10萬卡集群MFU提升了2.75倍。

會上,汪濤宣佈昇騰960芯片研發進度超出預期,實現性能翻番。其中,昇騰960DT將於2027年Q1推出,比原計劃提前三個季度;昇騰960PR將於2027年Q3推出,比原計劃提前一個季度。後續將堅持一年一代的演進節奏,昇騰970計劃2028年推出,昇騰980計劃2029年推出。依託τ定律的創新方向,實現算力規格繼續翻倍,訪存帶寬、訪存容量、互聯帶寬等也將大幅提升。

超節點的設計理念是通過互聯實現多NPU的協同。華爲研發了新一代NPO(Near-Packaged Optics)形態的光互聯產品——Hi-ONE,基於華爲自主創新技術,通過光、機、電、磁、熱等要素的均衡設計,實現了單引擎7.2T的傳輸容量。這是業界首個量產的NPO產品,是行業目前最大傳輸能力的NPO產品,也是唯一實現內置光源的NPO產品。

基於昇騰960芯片和Hi-ONE,華爲打造了業界首個採用NPO技術的超節點——昇騰960超節點,單個超節點爲4096卡規模,最大可提供8E FP8的算力,高達1PB的HBM容量。超節點中用5500個Hi-ONE,替代原本需要的4萬8千顆800G光模塊,降低了超550千瓦功耗,系統無故障運行時間提升一倍,系統可用度達到99.8%。

▍鯤鵬超節點與AI記憶存儲亮相,構築百萬卡超節點集群

隨着SOTA模型的參數規模達到10T級,其訓練、推理系統不再是單一的AI服務器或單一的智算超節點,而是一個複雜的算力系統。該系統包括智算超節點、通算超節點、一套平等互聯且免協議轉換的互聯繫統,在推理系統中還需要部署PB級的KV緩存集群。

據悉,鯤鵬超節點進行了升級。基於靈衢全光組網,鯤鵬超節點最大支持4096節點,並形成256TB的統一內存池。

此外,華爲基於靈衢打造AI記憶存儲-OceanStor M900。Agent與長序列需要多層次KV Cache架構,面向Agent推理系統,華爲提出了多層KV緩存架構,推出基於靈衢UnifiedBus、支持「一跳直連」的華爲L3.5層PB級KV緩存——OceanStor M900集群。同時,M900採用混合介質加優化Retention算法,可將SSD讀寫壽命提升16倍,從底層保障KV命中和長穩可靠。

同時,華爲帶來全新的Agentic超節點集群,加速10萬億大模型訓練和推理。基於靈衢UnifiedBus統一互聯,把多種互聯協議統一爲靈衢協議,大幅減少協議轉換開銷,實現昇騰超節點、鯤鵬超節點、KV緩存集群等子系統平等互聯,提供多層次、高帶寬、大容量的存儲系統,且各類KV緩存均可一跳直達的KV緩存。通過二層CLOS四平面組網,最大集群規模可達到51.2萬卡,再結合多軌道拓撲技術,最大可支持100萬卡昇騰超節點集群。

譯文內容由第三人軟體翻譯。


以上內容僅用作資訊或教育之目的,不構成與大象銀行相關的任何投資建議。大象銀行竭力但無法保證上述全部內容的真實性、準確性和原創性。