輝達(NVIDIA)正加速推進自研開源AI模型戰略,試圖以此擴大GPU需求,但這一策略也使其與部分重要客戶和投資物件形成競爭關係。據The Information 11日報道,輝達正在開發其Nemotron 4系列中規模最大的模型,目標是使其效能與全球最優秀的開源AI模型比肩。受此訊息影響,輝達美股盤前漲近2%。
據多名參與Nemotron專案的員工透露,輝達計劃開發的最大規模Nemotron 4模型引數量至少達到1萬億,約為其今年6月釋出的現有最大模型Nemotron 3 Ultra的兩倍。該模型引數規模仍將遠低於中國頭部開源模型,但輝達同時強調其壓縮技術可使較小模型實現超越性的效能表現。
在算力投入方面,輝達通過向購買其晶片的雲運營商租回AI伺服器獲取計算資源。截至今年4月,輝達多年期雲服務承諾金額已增至280億美元,覆蓋至2031年初,遠高於一年前的水平,約為一年前的三倍。其中,相當部分算力將專門用於Nemotron模型訓練。據悉,輝達已就Nemotron 4最大模型的預訓練資料和架構做出部分決策,但尚未確定最終規格和釋出日期,最終訓練執行也尚未啟動,該過程可能耗時數月。多名員工預計該模型最早將於今年秋季末釋出,另有員工認為時間可能更晚。
輝達當前的晶片需求高度依賴少數幾家前沿AI實驗室和雲運營商,包括OpenAI、微軟和SpaceX,而這些客戶中部分正在自研AI晶片。輝達推進Nemotron的核心邏輯,在於通過培育開源生態,吸引從初創企業到大型傳統企業的更廣泛使用者群體,從而降低對少數大客戶的依賴。輝達生成式AI副總裁Kari Briski在一封郵件中表示,輝達投資Nemotron,是因為相信每家公司、每個國家都需要可獲取的前沿開源模型,以強化安全保障、加速創新,並提供可跨代際依賴的基礎。輝達應用深度學習研究副總裁Bryan Catanzaro今年1月在一檔播客中也表示,投資Nemotron“對我們公司的未來至關重要”。
在商業落地方面,Nemotron模型已獲得部分企業採用,其中包括Palantir——該公司今年6月宣佈與輝達合作,將Nemotron模型用於美國政府客戶。不過,目前Nemotron 3 Ultra在Arena及Artificial Analysis等機構的多項效能基準測試中,在美國開源模型中僅排名第二,在全球所有模型中排名落在前40名之外。
輝達的開源押注使其陷入微妙處境:一方面與自身已投資的開源初創企業形成競爭,另一方面也對其最大客戶構成潛在威脅。輝達已向OpenAI投資300億美元,後者是其晶片需求的最重要驅動力之一。與此同時,輝達還對多家美國開源公司進行了大額投資,包括Reflection AI和Thinking Machines Lab,這些公司本身也在爭取企業客戶使用自有模型。
儘管如此,輝達仍通過構建“Nemotron聯盟”尋求協同效應。該聯盟成員包括Reflection、Cursor、Thinking Machines和Mistral,這些公司在開發自有開源專案的同時,也為Nemotron 4貢獻訓練資料、評估支援和模型設計建議。初創公司Prime Intellect為模型訓練貢獻了30萬個模擬環境;AI程式設計工具初創公司Cognition已就向輝達提供編碼訓練資料進行了討論,但其參與情況尚未正式公佈。Prime Intellect執行長Vincent Weisser將這一聯盟定位為抵抗“單一‘神’模型”壟斷格局的集體行動,而非爭奪最佳開源模型頭銜的競賽。
輝達的開源轉型也折射出AI競爭的地緣政治維度。據兩名員工透露,輝達去年初意識到美國開源模型已大幅落後,出於對自身商業價值的判斷,決定推動彌合這一差距。在資金規模上,輝達2028財年的雲服務承諾金額約為70億美元,與OpenAI和Anthropic的支出規模相比仍有差距,但已超過大多數頭部開源實驗室的歷史累計融資總額。一名員工透露,輝達正在努力爭取為Nemotron專案獲取更多算力。