阿里雲於7月23日宣佈,其自研晶片真武M890超節點已成功適配旗艦模型Qwen3.8,並正式上線阿里雲百鍊平台,對外提供模型推理服務。這是國內首個成功執行超2萬億引數大模型的超節點例項,標誌著國產AI基礎設施在支撐超大模型方面取得關鍵突破。

Qwen3.8是阿里最新發布的旗艦大模型,引數規模高達2.4萬億。執行如此規模的模型,通常需要將引數分散到數十甚至上百張高速互聯的GPU卡上,並解決高吞吐、低延遲、高併發的通訊瓶頸。普通AI叢集因通訊頻寬侷限,難以滿足這類需求。

真武M890是平頭哥推出的新一代訓推一體AI晶片,原生支援從FP32到FP4等多種資料精度,可覆蓋高精度訓練、低精度推理及超低精度推理等全場景。該超節點例項通過ICN Switch 1.0互聯晶片,將64張真武M890晶片連線在一起,實現了800GB/s的高速互聯,視訊記憶體規模達到9TB。單例項即可支撐大規模2萬億引數MoE(混合專家)模型的專家並行需求,大幅降低了模型部署的硬體門檻。

此外,阿里從晶片到雲平台層面實現了與Qwen模型的全鏈路最佳化。實測資料顯示,通過運算元最佳化和軟硬體架構協同,該超節點例項在Agentic推理場景中最多可實現1.5倍的推理效能提升。這意味著,在同樣硬體條件下,推理效率顯著提高,推理成本也隨之降低。

這一進展對AI產業投資者而言,意味著國產AI晶片在支撐超大規模模型推理方面已具備實際落地能力,不再僅停留在理論或小規模測試階段。阿里雲通過將自研晶片與自有模型深度繫結,有望在AI雲服務市場中形成差異化競爭力,並帶動國產AI晶片產業鏈(如互聯晶片、先進封裝、伺服器等)的需求增長。同時,這也為其他雲廠商和模型公司提供了“晶片-模型-平台”全棧協同的參考路徑,可能加速國內AI基礎設施的自主化程序。