9月2日,沙特AI公司HUMAIN釋出旗艦模型HUMAIN M3,官方宣稱其為“100%沙特模型”。然而,該模型的428B總引數、23B啟用引數配置與MiniMax此前釋出的MiniMax M3完全相同,引發社群質疑。釋出者蘇丹·阿爾法伊菲(Sultan Alfaifi)隨後澄清,HUMAIN M3是基於MiniMax M3開發的。
HUMAIN並非缺乏自研能力。2025年8月,這家由沙特主權財富基金組建的國家級AI公司曾釋出ALLaM 34B,由120多名AI專家、35名博士參與,在沙特境內從零訓練,主打阿拉伯語和本土文化對齊。然而,在旗艦模型上,沙特仍選擇將底座押在中國模型上,僅用自己的語料做後訓練。
類似“套殼”事件並非孤例。今年3月17日,日本樂天集團釋出Rakuten AI 3.0,號稱“日本國內最大規模的高效能AI模型”,背後有經濟產業省與NEDO支援的GENIAC專案,創始人三木谷浩史親自站台。但開發者很快在配置檔案中發現`model_type`為`deepseek_v3`,且樂天最初刪除了DeepSeek的MIT許可證檔案,換成自己的Apache 2.0授權,被社群扒出後才補上NOTICE檔案承認版權。
相比之下,東南亞國家更為透明。新加坡國家人工智慧計劃AISG在SEA-LION專案中改用阿里雲Qwen3-32B作為底座,推出Qwen-SEA-LION-v4,注入超1000億個東南亞語言token做後訓練。2025年5月,馬來西亞通訊部啟動“主權AI基礎設施”專案,基礎模型採用DeepSeek,這是DeepSeek首次以國家級規模在海外部署。
印度的情況則呈現兩種形態。169PI推出的32B模型Alpie被媒體稱為“印度版DeepSeek”,實為DeepSeek-R1-Distill-Qwen-32B,即以DeepSeek R1為教師模型蒸餾到Qwen基座。另一家公司Sarvam AI獲得IndiaAI Mission約9.9億盧比(約1100萬美元)算力補貼,宣稱“從零訓練”,但社群發現其配置與DeepSeek高度相似,CEO隨後承認“仰慕並學習DeepSeek”。
韓國國家級大模型競賽中,5支決賽隊伍至少3支使用中國開源模型:Naver隊的編碼器與阿里Qwen特徵相似,SK電訊隊推理程式碼與DeepSeek雷同,Upstage隊部分元件直接複製自智譜GLM,甚至未刪淨版權標記。歐洲方面,被馬斯克收購的Cursor在3月釋出程式設計模型Composer 2,開發者從API響應中發現其實際ID為“kimi-k2p5-rl-0317-s515-fast”,Cursor隨後承認基於月之暗面Kimi K2.5構建,走Fireworks AI授權合作。OpenAI前CTO米拉·穆拉迪創立的Thinking Machines釋出的975B開源模型Inkling,其MoE架構也源自DeepSeek-V3。
中國模型成為全球底座,首要原因是成本優勢。從零訓練大模型需數千萬美元資料中心投入,而DeepSeek、Qwen等開放權重模型採用MIT許可,允許商用、改權重和本地部署。Meta的Llama雖開源但不允許大規模使用,因此國家機構和大公司難以採用。中國模型配套工具鏈成熟,如ms-swift原生適配Qwen、DeepSeek、GLM,一條命令即可完成微調。DeepSeek的MoE架構每個token僅啟用37B引數,推理成本低,部署後執行成本下降。
其次,中國開源模型“規矩”少。各國既想發展AI又怕資料出境、怕閉源API被掐斷。2026年6月,白宮對Anthropic下達出口管制指令,要求暫停外國使用者訪問其最先進的Fable 5和Mythos 5,Anthropic僅給使用者90分鐘遷移。據4SAPI資料,禁令後68.4%的中大型企業客戶報告核心AI工作流效率下降,31.6%的小微開發者遷移部分工作負載,平均推理費用上漲27.3%。歐洲企業對此敏感,Llama 4許可證甚至不給歐盟開發者多模態權利,而中國模型的MIT、Apache 2.0許可無此限制。
此外,中國模型適配小語種需求。Qwen系列預訓練覆蓋119種語言和方言,適合東南亞、中東等非英語市場。DeepSeek、MiniMax M3的推理和工具呼叫能力強,符合“本國模型+本土Agent應用”的二次開發需求。
這種“被選中”背後,中國廠商展現出不同於美國閉源生態的姿態。美國廠商將模型底座視為明碼標價的生意:蘋果與谷歌合作,每年向谷歌支付約10億美元以讓Gemini驅動Siri;三星Galaxy AI採用Gemini,2025年覆蓋約4億台裝置,2026年目標翻倍至8億台;亞馬遜累計投資Anthropic 80億美元,2026年4月又宣佈先投50億,潛在總額最高330億美元,Anthropic承諾10年在AWS花費超1000億美元;微軟累計投入OpenAI超130億美元,按協議先拿走75%利潤分成直至收回投資,後降至49%,2026年4月27日雙方終止排他性合作並設利潤分成上限。
中國廠商則免費交出權重,不收授權費、不做利潤分成,甚至配合對方將模型包裝成本國驕傲。其回報在於生態與標準的複利:模型被越多國家採用,多語言能力越強;不同國情使模型使用方向多樣,Agent穩定性提升。當越來越多國家將模型建在中國底座上,中國模型便成為標準。據Presenc AI對Hugging Face全站下載量統計,Qwen3-VL-2B-Instruct是下載量第二高的模型,僅次於embedding模型all-MiniLM-L6-v2,也是Hugging Face唯二破億下載的模型。標準的價值,遠在授權費之上。