在近日於無錫舉辦的第三屆中國計算機學會晶片大會(CCF Chip 2026)上,中科通量釋出了全球首款RISC-V資料流架構影片智慧AIGC晶片——金剛GC3。該晶片採用12核設計,主頻2.0GHz,單晶片INT8算力達200 TOPS,FP16算力為32 TFLOPS,支援128路1080P@30fps硬解碼和64路硬編碼,專為影片場景定製,旨在解決通用晶片在影片處理中的效率瓶頸。

大會期間,兩院院士與工程師圍繞底層架構的“根技術”創新展開討論。核心議題是:當摩爾定律逼近物理極限、製程紅利稀薄時,堆核心、拼頻率的傳統路徑是否已到盡頭?與會者提出,與其在通用架構上打補丁,不如從資料流動的本質出發,為特定場景原生設計晶片。金剛GC3正是這一思路的產物,其定位並非通吃所有AI負載,而是專注影片流處理。

當前,AI算力消耗中影片佔據主導,從文生影片到城市攝像頭即時解析,再到工業產線質檢,影片流已成為AI基礎設施的主航道。然而,傳統CPU、GPU基於控制流架構,依賴程式計數器逐步推進指令,資料在記憶體與計算單元間頻繁搬運。中科通量總工程師羅鑫指出,在影片處理中,資料搬運消耗的能量往往是實際計算的數倍,這種“搬磚式”算力難以應對影片流的海量、連續、高併發特性。此外,影片編解碼與AI推理深度耦合,需要細粒度並行和極低延遲,通用架構的快取未命中、分支預測失敗等問題在影片場景下被放大。

資料流架構則採用“資料就緒即執行”模式,沒有程式計數器,計算節點在輸入齊備時自動觸發,結果直接傳遞,無需頻繁訪問全域性記憶體。這種模式天然契合影片流的多路並行需求,可大幅降低訪存開銷。中科院計算所研究員葉笑春在大會“資料流計算分論壇”上表示,資料流架構沒有程式計數器,只有“資料就緒即執行”。現場專家比喻,GPU如同萬人協同的大工廠,而資料流晶片則是自動化的智慧流水線,無空轉、無堵車。

金剛GC3的釋出被視為資料流架構從理論走向實戰的標誌。上海交通大學教授冷靜文評價,該晶片在影片AI推理上具備與主流GPU掰手腕的峰值能力,同等功耗下的影片處理密度是其差異化優勢。不過,現場也有專家提出編譯器易用性、生態建設、大規模工程落地等現實挑戰,這些問題表明資料流技術已進入實戰檢驗階段。

金剛GC3的定位折射出國產算力演進的新路徑:不在通用賽道追趕巨頭,而是在影片等場景深水區構築護城河。從跟隨適配到場景定義,該晶片釋放的訊號是,算力效率的最優解可能並非對通用架構的修補,而是從資料流動本質出發,為特定應用量身定製晶片。這一方向對AI基礎設施中的影片處理環節具有潛在影響,也為RISC-V生態在高階算力領域的商業化提供了新案例。