在2026年世界人工智慧大會(WAIC)上,中科曙光正式亮相了國產首個十萬卡量級AI超集群系統——曙光8000(登峰)。該系統於7月在光合組織2026智慧計算應用大會期間落成,一週後即在WAIC進行真機展示,也是國內首台明確採用“超智融合”技術路線的系統。

根據曙光8000公佈的最新執行資料,叢集上線後市場需求火爆,首周即實現應用滿載執行。目前日均處理作業數突破15萬個,單日處理作業峰值超過50萬個。中科曙光高階副總裁李斌曾表示,若全部算力用於推理,曙光8000將成為中國最大的Token工廠,能支撐當前全國5%~10%的Token需求。

曙光8000的任務覆蓋廣泛,從萬億級引數大模型的訓練和高通量推理,到超過300餘個重點科學工程計算應用,再到AI4S(AI for Science)的前沿探索。叢集還為下一代十萬億引數大模型預留了空間。

十萬卡叢集的工程挑戰

叢集規模從萬卡躍升至十萬卡,工程複雜度呈指數級攀升。李斌將核心挑戰歸結為效能效率與可靠性。在Scale-Up層面,中科曙光將640張加速卡集成於單個機櫃內,採用銅互聯以降低時延和功耗。在機櫃間,自研400G高速網絡卡880G交換晶片,構建國產原生RDMA高速互連網路Scale Fabric,實現十萬卡規模下的高頻寬、低時延通訊。李斌表示,Scale Fabric未來有能力實現對InfiniBand的全面國產化替代。

可靠性方面,十萬卡叢集元器件數量增加十倍,潛在故障點翻倍。曙光從最微小部件到每塊板卡,將單點可靠性提高一個數量級,並採用相變浸沒式液冷技術,使系統執行在恆定穩定環境中,大幅提高整機可靠性。

“超智融合”路線與科學計算

曙光8000的“超智融合”路線並非在不同機房分別部署超算和智算裝置,而是讓同一個計算單元同時覆蓋科學工程計算與神經網路計算。系統支援從FP64到INT8的多種計算精度,底層平台由6款達到國際先進水平的核心國產晶片、儲存和互連繫統等部件構成。

目前,曙光8000已與國內大模型團隊合作完成語言模型、語義模型和世界模型的萬卡級預訓練,併為超過400個主流模型提供線上推理服務。超過300項超智融合應用最佳化覆蓋大模型、機器人、創新藥、天文氣象等二十餘領域,其中70餘項已完成萬卡規模擴充套件。超過40%的AI4S專案已結合機器學習方法。

李斌透露,曙光還將與北京科學智慧研究院啟動第二套全國產十萬卡超智融合系統,下一代將更聚焦AI4S,以換取對科學任務更有針對性的支援。