輝達 H200 加速器終於通過個案許可進入中國大陸市場,字節跳動和騰訊近期各收到約 1 萬塊該晶片。這是自去年 12 月美國前總統特朗普批准對華出口以來,H200 首次大規模進入中國大陸,但每筆交易都受到中國國家發改委的嚴格審查,且大部分獲準數量(每家公司最高 10 萬塊)必須留在境外,主要存放於香港。

此次放行被視為中國在 AI 晶片領域的一次策略性讓步。今年 1 月,字節跳動、阿里巴巴和騰訊合計獲批購買超過 40 萬塊 H200,但實際進入大陸的僅約 2.5%。美國商務部於 1 月 16 日將許可證申請轉為個案審查,截至 5 月中旬已批准約 10 家公司,包括阿里巴巴、字節跳動、騰訊和京東,聯想和富士康則獲批作為分銷商。作為回應,中國國家發改委建立了逐筆採購審批流程,以對應美國的個案審查機制。

值得注意的是,中國要求進口晶片必須經香港中轉,這與美國要求所有晶片過境美國本土接受檢查的規定如出一轍。此外,中國網信辦去年 7 月曾就 H20 晶片涉嫌存在後門問題召見輝達,官方媒體隨後發起宣傳攻勢,稱該晶片不安全且過時,國家資助的資料中心也被禁止使用外國加速器。

輝達 CEO 黃仁勳曾向投資者表示,輝達在中國的市場份額已從 95% 降至零。而 DeepSeek 創始人梁文鋒在 5 月 20 日閉門投資者會議上的言論(7 月被洩露到網上)或許解釋了北京為何允許任何輝達晶片進入。據這份未經 DeepSeek 證實的檔案,梁文鋒曾希望獲得 20 萬塊華為加速器用於訓練前沿模型,但實際只獲得 1.6 萬塊,而華為今年總產能約 75 萬塊,需分配給所有中國 AI 公司。這一訊息導致 DeepSeek 暫停了一輪估值約 710 億美元的融資。

從 DeepSeek 的生產歷史看,其 R2 模型在華為昇騰硬體上的訓練嘗試屢屢失敗,最終訓練仍回到輝達晶片,昇騰加速器僅用於推理。H200 每塊配備 141GB HBM3e 記憶體,頻寬 4.8 TB/s,效能約為 H20 的六倍,接近被禁的 H100。1 萬塊 GPU 叢集具備真正的前沿訓練能力,可與 GPT-4 時代的算力規模相當,但與美國實驗室動輒 10 萬塊以上的系統相比仍有差距。

這一比例似乎經過北京官員的精確校準:足夠讓旗艦實驗室繼續訓練模型,但又不足以讓推理也依賴進口晶片,從而為國產晶片保留市場。TrendForce 8 月 10 日的供應鏈調查預測,今年國產晶片將佔據中國高階 AI 晶片市場近 90% 的份額,高端出貨量同比增長 83%,這一預測較其 12 月約 50% 的展望大幅上調。伯恩斯坦的研究則顯示,輝達在中國的份額已從 2024 年的 66% 降至 2025 年的 40%,預計今年僅剩 8%。

華為計劃在 2026 年將其 910C 昇騰晶片產量翻倍至約 60 萬塊,而中國加速器市場 2025 年總量約 400 萬塊,其中 236 萬塊由輝達和 AMD 供應。國產晶片雖能覆蓋數量需求,但仍無法滿足前沿訓練,因此 90% 的國產化預測與 H200 的放行是同一政策的兩面。

華盛頓方面認為,出口管制恰恰證明了其必要性:實施四年後,中國領先的實驗室仍無法在沒有美國晶片的情況下訓練前沿模型。梁文鋒在洩露的會議記錄中表示,開放獲取輝達晶片將使國產替代在商業上更加困難,這意味著管制本身為華為和寒武紀創造了市場。TrendForce 的資料顯示,在首次 Hopper 禁令三年後,國產晶片市場份額已接近 90%。

本月交付的晶片並未否定任何一方的理論,但輝達承擔了雙重代價:據報道其庫存積壓 50 萬塊晶片,每筆銷售需繳納 25% 的費用,且中國市場每個買家限購 1 萬塊——儘管這比零要好。