2026年的AI產業正經歷一場結構性撕裂:資本市場寒意陣陣,科創50指數7月累計跌幅約20%,融資盤持續淨賣出;而剛剛落幕的2026世界人工智慧大會(WAIC)上,H2算力主題展區人潮湧動,觀眾超40萬人次,全球177個重要採購團組預計達成意向採購金額約203.6億元。冰火交匯處,一個詞反覆出現在所有展台最醒目的位置——超節點(Super Node)

算力短缺是這場軍備競賽的直接推手。今年,智譜釋出GLM-5大模型,月之暗面推出高達2.8萬億引數Kimi K3大模型,但均被算力卡住,不得不靠提價、限購抑制需求。商湯大裝置披露,其日均Token服務量已達2.42萬億,預計2026年全年服務規模實現25倍增長。中國工程院院士鄭緯民指出,驅動智慧體的Token正在成為新的“石油”。然而供給端,輝達最新高階卡今年難以大批進入國內市場,存量供給幾乎未增長,需求暴漲與供給不動之間的缺口急劇擴大。

巨頭們正以真金白銀回應。Meta將2026年資本支出指引上調至1250億至1450億美元,幾乎是2025年的兩倍;微軟2026年Capex預計約1900億美元;摩根士丹利預測,五大雲廠商2026年資本開支將達8050億美元,2027年進一步升至1.116萬億美元。國內方面,字節跳動、阿里巴巴、騰訊2026年上半年AI相關資本開支同比增幅均超過50%。數千億美元砸向的不是單張顯示卡,而是一個個超節點

7月19日,鵬城實驗室與全球計算聯盟聯合釋出《超節點定義與實踐白皮書》,首次明確超節點是一種在物理上由多個計算節點通過高效互聯協議緊密連線、具備跨物理節點統一記憶體編址能力、邏輯上像“一台計算機”的計算系統。真正的超節點需具備三大技術特徵:超大頻寬超低時延統一記憶體編址,其中統一記憶體編址被視為靈魂,它使不同節點的記憶體納入同一地址空間,任意處理器可直接讀寫遠端記憶體。

華為在WAIC上首次公開展出昇騰950超節點真機,由16台計算櫃拼接成巨型陣列,1024張算力卡密集嵌入,提供1 EFLOPS FP82 EFLOPS FP4算力,擁有256TB全域性統一記憶體編址空間,RTT時延控制在3微秒以內。作為對比,輝達當前基於傳統電互聯方案的單叢集上限約為128張GPU卡,昇騰950直接將這一數字拉至1024。阿里雲釋出靈駿真武M890超節點例項,首次通過公共雲對外提供超節點形態的AI算力服務;壁仞科技推出支援單個超節點1024卡擴充套件的NPO光互連方案。中興通訊、燧原科技、沐曦股份、中科曙光、百度智慧雲等均將超節點置於展台核心。

多家機構將2026年稱為國產超節點方案量產元年。華泰證券測算,2028年國產超節點市場空間有望達到3414億元,2026年至2028年複合年均增長率高達194%。資本市場已給出回應:7月1日至22日,紫光股份股價累計上漲58%,浪潮資訊上漲41%。

超節點崛起的背後是算力需求從“單機八卡”向“萬卡/十萬卡”叢集的演變,而傳統“堆卡”思路已走到盡頭。GPT-5級別大模型訓練中,跨節點通訊開銷佔總訓練時間三成以上;GPU算力每年提升2到3倍,但記憶體頻寬一年只漲15%到30%,兩者差距持續拉大。單顆晶片效能逼近天花板,只能靠更快連線更多晶片來擴充套件算力規模。一位伺服器廠商高管透露,網際網路客戶第一句話就是“你有10萬片的供應,我們再談”。超節點價格比傳統伺服器貴50%,但效能可提升10倍,客戶能算清這筆賬。

智慧體(Agentic AI)的爆發進一步放大了超節點的價值。傳統大模型推理是“一次請求、一次回答”,而智慧體在更長上下文中持續執行規劃、檢索、呼叫工具、寫入記憶和結果驗證,導致上下文瘋狂膨脹:長上下文推理的KV Cache從64K到1000萬token時,容量需求從百GB級跳升至TB級;單使用者單次對話可產生約10GB KV快取,千級併發場景總量可達1TB。IDC資料顯示,2026年全球資料總量將達274ZB,2030年飆升至718ZB,儲存從輔助配套變為核心底座。超節點通過統一記憶體編址,使海量KV快取、智慧體長期記憶、頻繁呼叫的上下文資料在一個統一邏輯空間內高效流轉,無須反覆搬運。

輝達的Vera Rubin平台已給出示範,其部署在5類機架中,多機架組網形成統一POD級AI超算叢集,分工覆蓋GPU計算、CPU計算、低時延推理、上下文儲存和網路互聯。推理上下文記憶儲存平台可擴充套件AI智慧體的長期記憶,將每秒處理的token數量和能效提升高達5倍。

超節點不是錦上添花,而是必由之路。它通過系統級架構創新——超大頻寬、超低時延、統一記憶體編址——把成百上千張晶片變成“一台計算機”,讓算力、儲存、記憶體在統一邏輯空間內高效協同。這不僅是算力規模的提升,更是算力效率的質變。智慧體的未來,取決於超節點的普及程度。