中科曙光在6月15日正式釋出新一代通用高效能運算平台,核心亮點是首次搭載國產百核級通用CPU。根據披露的規格,該平台FP64雙精度浮點算力達到10TFLOPS,整體效能指標被描述為首次達到國際廠商旗艦級水平,這對長期關注國產計算生態的觀察者而言是一個值得注意的節點。

在具體效能提升上,平台HPL雙精度浮點效能較上一代提升近2倍,STREAM訪存效能提升近1倍。這兩個指標分別對應大規模科學計算與資料吞吐能力,是衡量高效能運算平台實際可用性的關鍵維度。訪存效能的翻倍增長,意味著在處理AI訓練中常見的大規模稀疏資料或高併發資料流時,資料搬運效率有了明顯改善。

更值得關注的是系統級協同設計。中科曙光強調了“算—存—網”三級協同架構,並披露了自研scaleFabric高速網際網路絡的關鍵引數:端到端時延低至0.93微秒,單子網支援11.4萬卡組網。在大規模平行計算場景下,節點間通訊延遲往往是制約整體效率的“通訊牆”,0.93微秒的時延與超過11萬卡的組網能力,表明該平台在擴充套件性上試圖直接應對萬卡級叢集的互聯挑戰。

從產業角度看,這一發布發生在國產算力底座加速建設的背景下。當前AI大模型訓練對雙精度算力與大規模組網的需求持續攀升,而此前國產平台在這兩項指標上與國際旗艦產品存在代差。此次中科曙光將雙精度算力推至10TFLOPS並公開網際網路絡的具體時延與規模,為國內AI基礎設施的自主供應提供了新的選項。不過,實際部署中的穩定性、軟體生態適配以及量產成本,仍是後續需要觀察的環節。