彭博產業研究(Bloomberg Intelligence,簡稱 BI)資深分析師 Robert Lea 在週一(5 日)釋出的報告中給出一個判斷:隨著 DeepSeek 等中國 AI 實驗室持續追趕,美國企業對中國競爭對手的領先優勢已急劇縮小,降至歷史新低。報告認為,這一趨勢可能對美國在 AI 領域的科技霸主地位構成威脅。

報告的核心資料來自基準測試成績的對比。DeepSeek 在 9 月釋出 V4.1 Flash 之後,中國頂尖 AI 模型與美國競爭對手的測試差距已縮小到僅 3%;作為對照,今年 5 月這一差距為 9%,年初則為 15%。Lea 表示,模型效能的持續提升,意味著中國 AI 業者有望藉此取得市場份額。

從具體排名看,V4.1 Flash 上月在 LiveBench 全球排名第六,成為自 DeepSeek 於 2025 年推出推理模型 R1 取得突破以來,排名最高的中國 AI 模型。LiveBench 依據模型對問題、謎題與任務的回答和分析能力打分,評估思路類似衡量人類智商。DeepSeek 最新 LiveBench 得分為 81.1,低於 Anthropic 最佳模型的 83.4。Lea 認為,這一成績說明 DeepSeek 模型的效能已可與 Anthropic 及 OpenAI 的頂尖系統相媲美。

不過報告也給出了兩點保留。其一,儘管分差已縮至 3%,LiveBench 評選的前 15 名模型中仍只有 3 個來自中國,說明中國模型在頭部梯隊中的整體佔比依然有限。其二,Lea 提醒這類排名會持續變動,排行榜上的亮眼表現並不等同於商業化成功。

報告把中國 AI 崛起部分歸因於兩點:AI 技術專業能力的深化,以及中國在國產硬體上最佳化模型的能力不斷提升。與此同時,美中兩大經濟體正競相爭奪 AI 主導權,這被視為影響經濟生產力、軍事優勢與全球影響力的關鍵變數。在使用者數量層面,中國低成本 AI 模型正逐步縮小與美國的差距;而在美國一側,Anthropic 與 OpenAI 等公司正積極追求兆美元級估值。

商業化路徑是報告著墨較多的部分。Lea 指出,中國 AI 模型正面臨美國日益嚴格的監管審查,甚至可能遭遇禁令,背景是外界指控中國業者涉及模型蒸餾(model distillation)等行為。他預計,中國 AI 產業可能要到 2030 年才能實現獲利。原因在於低毛利的 Token 供應模式與激烈價格戰並存——中國市場目前充斥超過 1,100 個大型語言模型,這種格局可能讓任何一家企業都難以建立真正的競爭優勢。

在 AI 應用程式的商業化方面,報告稱字節跳動旗下 豆包 目前處於領先地位,而 DeepSeek 與騰訊旗下聊天機器人目前仍維持免費。Lea 認為,中國 AI 產業若要建立可持續的獲利模式,需要降低競爭壓力、推動產業淘汰整並,並採取更理性的定價策略。

把這些線索放在一起看,這份報告呈現的是一幅「效能追趕快、商業兌現慢」的圖景:一方面,中美頭部模型的基準分差在不到一年內從 15% 壓縮到 3%,技術層面的追趕速度超出此前預期;另一方面,榜單名次、使用者規模與盈利能力之間仍存在明顯落差,監管風險與價格戰又在壓制單位經濟模型。對關注 AI 產業的讀者而言,值得跟蹤的變數包括中國模型在頭部榜單中的數量佔比能否繼續上升、國產硬體適配帶來的成本曲線變化,以及行業整合與定價策略是否會出現拐點。