中國兩家主要科技公司本週先後公佈AI基礎設施與模型進展,均把重點放在擴大訓練與推理規模上。華為在9月17日於上海舉行的年度全聯接大會2026上,圍繞新發布的Peerium計算架構展示了一系列產品,覆蓋伺服器、儲存和網路,目標包括大規模AI推理以及訓練引數規模最高達10萬億的模型。

儲存方面,華為推出OceanStor M900上下文記憶儲存,面向在其SuperPoD上執行的AI模型,提供拍位元組級鍵值快取與全域性單跳連線。該產品單叢集支援最高64PB的SSD儲存,將CPU、網路控制器單元和NAND控制器集成於單一單元,單叢集聚合頻寬達40 TB/s。華為稱,每顆接入M900的昇騰NPU可支援數TB的KV快取,使單一上下文視窗可超過100萬token。

互聯是Peerium架構的另一核心。華為推出Unified Bus,將隨OceanStor M900出貨,用於縱向擴充套件、橫向擴充套件和跨域連線,整合多種網路協議,在銅纜和光連線上提供TB級每秒頻寬。縱向擴充套件由UnifiedBus LinkBlade承擔,採用無纜設計,可在單個SuperPoD中連線最多4096顆NPU;橫向擴充套件由UnifiedBus LinkDevice光交換機承擔,每埠1.6 Tbit/s頻寬、共176個埠,聚合頻寬280 Tbit/s;UnifiedBus UBG交換機可連線最多1024台終端裝置,支撐華為構建百萬NPU級SuperCluster,並讓客戶訓練最高10萬億引數的模型。

華為同時釋出新的AI SuperCluster,包括TaiShan 950和Atlas 960 SuperPoD,後者由OceanStor M900和星河UBG交換機組成,華為稱其將是業界首款採用近封裝光學(NPO)的伺服器。公司還推出基於UnifiedBus的鯤鵬和昇騰系列新裝置,支援1至8顆NPU。面向需要執行最高1萬億引數模型的小型客戶,華為提供由兩台Atlas 650E風冷伺服器直接通過UnifiedBus連線的小規模SuperPoD方案,可在16顆NPU間實現無交換機互聯。華為表示,迄今已部署超過1000套Atlas 900 A3 SuperPoD,Atlas 950 SuperPoD正在大規模商用,最新昇騰960晶片正在開發中,預計2027年初交付。

華為副董事長、輪值董事長汪濤表示,公司昇騰晶片系列按一年一代的節奏演進,2028年和2029年將分別推出昇騰970和980晶片;得益於Tau Scaling Law,其計算規格將繼續翻倍,記憶體頻寬、記憶體容量、互聯頻寬等方面也將大幅提升。

阿里巴巴本週在年度雲棲大會上同樣公佈多項晶片與AI進展。其晶片設計部門平頭哥釋出最新AI訓練與推理處理器真武V900,配備216GB GPU記憶體和1.2 TB/s片間頻寬,為前代真武M890的三倍,支援FP8和FP4,可處理混合AI負載,計劃2027年第一季度釋出。阿里還推出升級版“超級節點伺服器”,整合真武V900處理器、ICN交換機、磐脈SmartNIC和振嶽SSD控制器晶片,可組成最多50萬張計算卡的叢集。

CPU方面,阿里公佈下一代倚天720路線圖,計劃2027年推出,稱其單核效能、核心密度和能效均優於倚天710;基於平頭哥自研微架構開發的倚天730,效能將比倚天710提升40%。

模型方面,阿里宣佈下一代模型Qwen 4正在訓練中,並稱即將推出的Qwen 4.5和Qwen 5系列可擴充套件至10萬億引數。阿里表示,Qwen模型通過遞迴自我改進(RSI)持續提升,Qwen3.8-Max在一個月的全自動訓練中完成了超過33個RSI週期。

兩家公司的釋出集中在同一周,顯示中國科技企業正從晶片、互聯、儲存到模型多個環節同步推進規模化能力。對關注AI算力供應鏈的投資者而言,這些路線圖提供了觀察國產AI基礎設施演進節奏的視窗,但相關產品多數尚未上市或交付,實際落地進度仍需跟蹤。