7 月 19 日,上海,世界人工智慧大會。兩天前,月之暗面剛用 2.8 萬億引數的 Kimi K3 重新整理「史上最大開放模型」紀錄[6],全球半導體股應聲抖了一輪。所有人都在等阿里的回牌,等到的東西比預想的更重:通義團隊端出 Qwen3.8 Max 預覽版,2.4 萬億引數,官方內部評測給它的位置是——綜合能力僅次於 Anthropic 的 Fable 5[1]

然後是真正讓同行倒吸一口氣的那句話:正式版將於近期釋出,並開源完整權重[2]

自評全球第二強的模型,標價為零。權重一旦放出,任何對手都能下載、蒸餾、改造、商用。按閉源實驗室的商業常識,這等於把鎮店之寶搬到大街上任人拓印。謎面就擺在這裡:阿里圖什麼?

答案不在技術裡,在生意裡。開源在這一步不是姿態,是武器:把模型層修成一條免費公路,閉源對手賴以為生的 API 溢價就會塌陷;而路修好之後,錢在收費站收——訂閱、雲算力、資本市場,全是阿里坐著的位置。同一周裡,中國兩張最強的開放模型牌,自研的 Qwen3.8 與被投的 Kimi K3,都通向同一家公司。模型層越不值錢,收租的位置就越值錢。

標價為零的第二名

先把謎面釘牢。Qwen3.8 Max 是 Qwen 系列迄今塊頭最大的多模態旗艦,文本、影像、影片、文件都吃[4];官方稱它在程式碼工程和專業辦公場景表現突出[2]。釋出場合選在世界人工智慧大會,時間卡在 Kimi K3 釋出之後第二天——牌桌上的座次感,誰都看得出來[4]

同一天,阿里雲把商業動作也擺上了檯面:Token Plan 個人版訂閱上線,限時折扣下分三檔,Lite 39 元/月、Standard 139 元/月、Pro 499 元/月(原價 60、180、600 元),團隊版席位從每月 150 元到 1398 元,訂閱使用者可以搶先呼叫 Qwen3.8-Max-Preview[2][3]

一邊收著訂閱費,一邊承諾把模型本體免費送出去。這兩個動作擺在同一天,本身就是謎面的一部分。還有一處懸空:截至預覽版上線,基準測試表、模型卡、開源許可證都沒露面——「僅次於 Fable 5」暫時只是內部評測的自我排位[4]。謎沒有變小,反而更大了:連成績單都還沒交的模型,憑什麼先把「送出去」寫進承諾?

把幾種順手的解釋一個個擺上來,再一個個劃掉。

不是打不過,才把桌子掀了

最流行的解釋:開源是追趕者的武器,打不過閉源霸主,索性免費放血,換生態、換人心。這個解釋在阿里自己的歷史上就站不住。

2024 年 6 月阿里釋出 Qwen2 時,9 月只開放了部分模型權重,最先進的留在手裡[13];2025 年 4 月的 Qwen3 系列訓練於 36 萬億 token、119 種語言,其中引數超 1 萬億的 Qwen3-Max 一直是專有模型、只通過 API 售賣[13]。弱的時候藏著掖著,強的時候反而攤開——方向和「打不過才開」正好相反。

而中國前沿模型這一週的成色,也不缺第三方佐證。Kimi K3 在 Arena 前端程式碼競技榜以 1679 分登頂,成為首個在該榜單奪冠的中國模型;再往前,Kimi K2.7 是 Anthropic 內部安全測試中唯一達標上榜的中國模型。差距當然還在:據 The Decoder,K3 在 FrontierMath 第四檔高難數學上的準確率只有約 39%,遠低於 OpenAI 與 Anthropic 模型近 90% 的水平——尖端推理這座山還沒翻過去。但恰恰是這一點反過來堵死了「敗退開源」的解釋:真要掩飾差距,更該閉源收門票,靠資訊不對稱把價定高;把權重攤開,等於請全世界拿放大鏡來量你。這是有底氣者的動作,不是敗退者的。

也不是為了刷聲量

第二種解釋:開源承諾是免費的廣告。這個解釋解釋不了成本,也解釋不了同一周的另一個動作。

刷聲量,預覽版加一句「僅次於 Fable 5」已經足夠——釋出當天全網刷屏,什麼權重都不用放。而真放權重的代價是實打實的:Hugging Face 上 Qwen 的開源變體已超過 20 萬個[13],連微軟都拿 Qwen2.5-7B 當基座訓練自己的安全對齊模型——朋友能拿去用,對手同樣能拿去蒸餾、微調、二次包裝。聲量不需要付這種成本。

更蓋不住的是同一周的配套動作:阿里旗下平頭哥宣佈把真武 AI 晶片的軟體棧 T-Head SAIL 全面開源,給開發者一個 CUDA 之外的替代,主流 AI 框架七天內可完成適配(據 TechNews 科技新報)。為了熱搜,沒有人會把晶片的軟體底座也送出去。從模型權重到晶片軟體棧一起開,這是體系,不是營銷。

更不是慈善

第三種解釋最省事:中國公司信仰開放。可是賬本不信仰任何東西。

Token Plan 的三檔訂閱費就是同一天收的[2];Qwen3-Max 此前一直閉源收 API 錢[13];再往前數,此前兩代 Max 級旗艦都停在閉源[4]。從 2023 年 4 月通義千問 beta 上線算起[13],哪一代開、哪一代不開,全是逐案決策,不是教義。2022 年 Hugging Face 在中國受限後,阿里專門建了 ModelScope 平台承接開源分發[13]——開源在這家公司的賬上,從頭到尾記在「渠道建設」科目下。截至 2025 年初,阿里已放出超過 100 個開放權重模型、累計下載超 4000 萬次[13],但開源線與旗艦線一直分池而治:2026 年 2 月的 Qwen3.5 說開就開,Max 從來不放[13]。做了十幾年生意的公司,哪個池子開閘、哪個池子鎖死,每一筆都是算過的。這一次的反常在於:承諾第一次把旗艦池也划進了公地。

三種解釋劃掉了。剩下的那個,得從「誰在為模型付錢」這件事本身說起。

謎底:公路免費,收費站收租

閉源實驗室的商業模式建立在一個前提上:前沿智慧是稀缺品,稀缺品可以收溢價。開源旗艦模型攻擊的正是這個前提——當「接近最強」的權重可以免費下載,付費 API 的定價權就開始漏氣。

漏氣已經不是推演,是報表。OpenRouter 的資料顯示,美國公司在該平台上處理的 Token 中,經中國模型處理的比例近期達到約 58%,創下紀錄;這一比例自 1 月中旬以來翻了三倍,3 月首次超過美國模型——而 2025 年初,中國模型佔比還不足 10%,美國模型約佔 80%[7]Databricks CEO Ali Ghodsi 對 CNBC 說,公司在託管 Kimi 這樣的開源模型,GPU 都不夠用了[11];這家公司還把工程師的預設程式設計模型換成了中國開源的 GLM 5.2,理由是比 Anthropic 的 Opus 省約 34% 的成本[12];Coinbase 把 Kimi K2.7 設為工程師預設模型後,AI 賬單減半。公地不是理念,公地已經在被踩出路來。

那麼錢在哪裡?看阿里在公路旁邊修了什麼。

第一個收費站是訂閱。Token Plan 按 Credits 計費,模型免費不等於服務免費——權重是公地,託管、排程、工具鏈、搶先體驗是私產[2][3]。第二個收費站是雲,也是最重的一個。2.4 萬億引數的權重放在網上人人可取,可有能力把它跑起來的機構屈指可數——同量級的 Kimi K3,推理部署起步就要 64 顆晶片組成的擴充套件域。開源大模型每一次被認真使用,幾乎都對應一筆算力賬單,而阿里雲是 Gartner 口徑下中國及亞太最大的雲服務商,運營 29 個區域、87 個可用區;2025 年 2 月,阿里官宣未來三年至少投入 3800 億元人民幣(約 530 億美元)建雲和 AI 基礎設施,超過它此前十年在這上面花的總和;官宣那一刻,阿里雲 AI 相關產品收入已經連續六個季度保持三位數增長[5]。公路旁邊的收費站,地基早就打了,而且已經開始收錢。Kimi K3 釋出 48 小時請求量逼近叢集極限、被迫暫停 C 端新使用者訂閱[10]——開放模型的勝利,最直接的形態就是算力不夠用。

第三個收費站是分發。阿里已確認通義千問將整合進蘋果中國區的 Apple Intelligence,覆蓋 iOS、iPadOS、macOS 和 visionOS[8],據鈦媒體,千問在國行蘋果 AI 中主導約 65% 的任務;榮耀的 RobotPhone 用千問打底,一汽基於千問自研的汽車行業大模型入駐了阿里雲百鍊平台,Qwen 應用自身已有 2.34 億使用者,並已接入阿里系的外賣服務,淘寶、飛豬在排隊。第四個收費站在資本市場:蘋果訊息公佈當天,阿里 ADR 盤前漲約 4%——對一家市值約 2800 億美元的公司[15],敘事從「電商折價股」換軌到「AI 基礎設施」,每一格都是真金白銀。

這套拳,阿里二十年前打過一遍。當年 eBay 在中國靠交易收費,淘寶宣佈開店免費,把集市修成公地,然後在流量和廣告上把錢收了回來。今天模型層扮演的,就是當年「開店費」的角色:對手靠它活,阿里把它歸零。

兩張牌,一隻手

看懂這步棋,同一周的另一件事才顯出分量。Kimi K3 走的是幾乎相反的變現路:模型開源,API 卻定價與 Anthropic 的 Sonnet 相當,是中國主流模型中最高的——把模型本身賣出溢價的路線,與阿里「送模型、收租金」的路線正好是一枚硬幣的兩面。

但硬幣無論落在哪一面,都落在同一隻手裡。2024 年 2 月,阿里領投月之暗面 10 億美元融資,當時獲得 36% 的股份[14]。兩年多過去,月之暗面新一輪融資投前估值已到 315 億美元,年度經常性收入突破 3 億美元、API 佔比超七成,並已向投資人發出上市議案,最快 6 個月內完成港股 IPO[9]。自研的 Qwen3.8 贏,阿里收訂閱和雲;被投的 K3 贏,阿里的股權在港交所變現。摩根士丹利說中國大模型正在規模、效能、定價三個維度同步追趕[6]——追趕的兩支先頭部隊,資本關係上都連著杭州。這才是「雙旗艦」的真正含義:不是一家公司發了兩個模型,是一個資本結構押了兩條路線。

承諾兌現之前

陽謀要成立,還差幾步,每一步都不虛。

第一步是承諾本身。預覽版沒有放出權重,措辭是「正式版將於近期釋出並開源」[2]——沒有日期,沒有許可證。此前兩代 Max 旗艦都停在了閉源[4],承諾與兌現之間,隔著一次真正的上傳。第二步是成績單。「僅次於 Fable 5」出自內部評測,基準表和模型卡都還沒交[4];在第三方把它量完之前,「全球第二」是一句需要抵押物的話。

第三步在牌桌之外。美中經濟與安全審查委員會的報告已經把中國開源模型定性為克服算力限制、擴充套件資料管理能力的關鍵路徑——被寫進這種報告的能力,往往離被針對不遠。而脫鉤是雙向的:7 月 10 日起,阿里以發現檢測中國使用者的隱藏程式碼為由,禁止員工使用 Anthropic 的 Claude Code,強制改用自研的 Qoder。據 Yahoo Finance,自 6 月 22 日以來全球半導體市值已蒸發約 3.3 萬億美元,市場已經把開放模型當成系統性變數在重新定價,公地的修路人自己也站在震區裡。

最後一步,是這盤棋真正的賭注:公路免費的前提,是收費站真能收到錢。訂閱要留得住被免費權重養刁的使用者,阿里雲要接得住全世界跑 2.4 萬億引數的流量——K3 上線兩天就把叢集擠到極限的那一幕[10],既是這個賭注的最好廣告,也是它的壓力測試。權重上傳的那一天,模型層才正式變成公地;而租收不收得上來,要看之後的每一張算力賬單。