中科曙光釋出scaleFabric Token加速技術體系,並稱該體系實現了IBGDA技術在國內的首次規模化應用。
根據36氪的報道,scaleFabric以原生無損RDMA高速網路為基礎,構建了“算存傳”三級緊耦合的Token加速超級通道。其中,支援GPU直接發起網路通訊的IBGDA技術,在國內首次實現規模化落地,並已在十萬卡級大規模叢集中完成驗證。
在生態適配方面,scaleFabric已完成DeepEP等通訊框架的適配,並通過IBGDA、儲存直通等技術提升Token流轉效率,為國產大模型提供新的高速互連選擇。
從產業角度看,大模型訓練對叢集內部的資料交換效率高度敏感,Token在計算、儲存與網路之間的流轉速度,直接影響訓練任務的吞吐和穩定性。IBGDA允許GPU繞過部分傳統通訊路徑直接發起網路通訊,理論上可降低延遲、提升頻寬利用率。中科曙光此次將這一技術推向規模化驗證,並完成與DeepEP等框架的對接,意味著國產高速互連方案在軟體生態相容性上邁出一步。
不過,技術體系的實際效能表現、在更多模型與框架上的通用性,以及後續的部署成本與運維複雜度,仍有待更多公開資訊驗證。對於關注國產算力基礎設施的讀者而言,scaleFabric的進展提供了一個觀察國產高速互連技術從實驗室走向大規模叢集的視窗。