9月2日,沙特AI公司HUMAIN发布旗舰模型HUMAIN M3,官方宣称其为“100%沙特模型”。然而,该模型的428B总参数23B激活参数配置与MiniMax此前发布的MiniMax M3完全相同,引发社区质疑。发布者苏丹·阿尔法伊菲(Sultan Alfaifi)随后澄清,HUMAIN M3是基于MiniMax M3开发的。

HUMAIN并非缺乏自研能力。2025年8月,这家由沙特主权财富基金组建的国家级AI公司曾发布ALLaM 34B,由120多名AI专家、35名博士参与,在沙特境内从零训练,主打阿拉伯语和本土文化对齐。然而,在旗舰模型上,沙特仍选择将底座押在中国模型上,仅用自己的语料做后训练。

类似“套壳”事件并非孤例。今年3月17日,日本乐天集团发布Rakuten AI 3.0,号称“日本国内最大规模的高性能AI模型”,背后有经济产业省与NEDO支持的GENIAC项目,创始人三木谷浩史亲自站台。但开发者很快在配置文件中发现`model_type`为`deepseek_v3`,且乐天最初删除了DeepSeek的MIT许可证文件,换成自己的Apache 2.0授权,被社区扒出后才补上NOTICE文件承认版权。

相比之下,东南亚国家更为透明。新加坡国家人工智能计划AISG在SEA-LION项目中改用阿里云Qwen3-32B作为底座,推出Qwen-SEA-LION-v4,注入超1000亿个东南亚语言token做后训练。2025年5月,马来西亚通信部启动“主权AI基础设施”项目,基础模型采用DeepSeek,这是DeepSeek首次以国家级规模在海外部署。

印度的情况则呈现两种形态。169PI推出的32B模型Alpie被媒体称为“印度版DeepSeek”,实为DeepSeek-R1-Distill-Qwen-32B,即以DeepSeek R1为教师模型蒸馏到Qwen基座。另一家公司Sarvam AI获得IndiaAI Mission约9.9亿卢比(约1100万美元)算力补贴,宣称“从零训练”,但社区发现其配置与DeepSeek高度相似,CEO随后承认“仰慕并学习DeepSeek”。

韩国国家级大模型竞赛中,5支决赛队伍至少3支使用中国开源模型:Naver队的编码器与阿里Qwen特征相似,SK电讯队推理代码与DeepSeek雷同,Upstage队部分组件直接复制自智谱GLM,甚至未删净版权标记。欧洲方面,被马斯克收购的Cursor在3月发布编程模型Composer 2,开发者从API响应中发现其实际ID为“kimi-k2p5-rl-0317-s515-fast”,Cursor随后承认基于月之暗面Kimi K2.5构建,走Fireworks AI授权合作。OpenAI前CTO米拉·穆拉迪创立的Thinking Machines发布的975B开源模型Inkling,其MoE架构也源自DeepSeek-V3。

中国模型成为全球底座,首要原因是成本优势。从零训练大模型需数千万美元数据中心投入,而DeepSeek、Qwen等开放权重模型采用MIT许可,允许商用、改权重和本地部署。Meta的Llama虽开源但不允许大规模使用,因此国家机构和大公司难以采用。中国模型配套工具链成熟,如ms-swift原生适配Qwen、DeepSeek、GLM,一条命令即可完成微调。DeepSeek的MoE架构每个token仅激活37B参数,推理成本低,部署后运行成本下降。

其次,中国开源模型“规矩”少。各国既想发展AI又怕数据出境、怕闭源API被掐断。2026年6月,白宫对Anthropic下达出口管制指令,要求暂停外国用户访问其最先进的Fable 5和Mythos 5,Anthropic仅给用户90分钟迁移。据4SAPI数据,禁令后68.4%的中大型企业客户报告核心AI工作流效率下降,31.6%的小微开发者迁移部分工作负载,平均推理费用上涨27.3%。欧洲企业对此敏感,Llama 4许可证甚至不给欧盟开发者多模态权利,而中国模型的MIT、Apache 2.0许可无此限制。

此外,中国模型适配小语种需求。Qwen系列预训练覆盖119种语言和方言,适合东南亚、中东等非英语市场。DeepSeek、MiniMax M3的推理和工具调用能力强,符合“本国模型+本土Agent应用”的二次开发需求。

这种“被选中”背后,中国厂商展现出不同于美国闭源生态的姿态。美国厂商将模型底座视为明码标价的生意:苹果与谷歌合作,每年向谷歌支付约10亿美元以让Gemini驱动Siri;三星Galaxy AI采用Gemini,2025年覆盖约4亿台设备,2026年目标翻倍至8亿台;亚马逊累计投资Anthropic 80亿美元,2026年4月又宣布先投50亿,潜在总额最高330亿美元,Anthropic承诺10年在AWS花费超1000亿美元;微软累计投入OpenAI超130亿美元,按协议先拿走75%利润分成直至收回投资,后降至49%,2026年4月27日双方终止排他性合作并设利润分成上限。

中国厂商则免费交出权重,不收授权费、不做利润分成,甚至配合对方将模型包装成本国骄傲。其回报在于生态与标准的复利:模型被越多国家采用,多语言能力越强;不同国情使模型使用方向多样,Agent稳定性提升。当越来越多国家将模型建在中国底座上,中国模型便成为标准。据Presenc AI对Hugging Face全站下载量统计,Qwen3-VL-2B-Instruct是下载量第二高的模型,仅次于embedding模型all-MiniLM-L6-v2,也是Hugging Face唯二破亿下载的模型。标准的价值,远在授权费之上。