微軟 CEO 薩提亞·納德拉近日在其部落格上發表文章,對 OpenAIAnthropic 等領先 AI 實驗室提出尖銳批評,指出這些公司存在一種他稱之為“逆向資訊悖論”的矛盾行為。

納德拉的核心論點是:這些 AI 實驗室一方面在“合理使用”的法律主張下,大規模抓取並訓練網際網路上的公開資料;另一方面,它們卻在自身的服務條款中明確禁止其他公司對自己的模型進行蒸餾——即讓小模型通過模仿大模型輸出來學習的技術。更關鍵的是,這些實驗室還能從企業客戶與 AI 系統的每一次互動中持續學習,包括使用者對模型輸出的修正、評分和使用模式,納德拉將這些互動痕跡稱為“資料廢氣”。

他在文章中寫道:“在消費智慧的過程中,你也在創造智慧。”這意味著企業實際上為 AI 支付了兩次成本:第一次是直接的金錢,第二次則是無意中洩露了自身內部的專有知識。這些知識被 AI 提供商吸收後,可能被用於構建具有競爭性的產品,而企業卻無法從這一迴圈中獲得對等回報。

納德拉認為,這種不對稱的格局導致經濟價值不成比例地流向基礎設施運營商,而非那些真正產生知識和資料的公司。他的解決方案是呼籲企業掌控自己的學習閉環——即擁有並控制用於訓練和微調 AI 的完整基礎設施。

值得注意的是,微軟恰好是能夠提供此類解決方案的主要廠商之一。通過其 Azure 雲平台和 AI 服務,微軟可以向企業出售算力、儲存和模型訓練工具,幫助企業構建私有的、可控的 AI 學習環境。納德拉的這番表態,既是對產業現狀的觀察,也帶有明確的商業戰略意圖。

從產業角度看,這一爭論觸及了 AI 發展中的幾個深層矛盾。首先是資料權利的界定:公開資料用於訓練是否應無限制?其次是模型蒸餾的法律與商業邊界:當一家公司禁止他人蒸餾自己模型的同時,自身卻依賴公開資料訓練,這種雙重標準是否合理?最後是企業資料主權問題:客戶在與 AI 系統互動時產生的反饋資料,究竟屬於誰?

納德拉的批評並非孤立事件。近年來,圍繞 AI 訓練資料的版權訴訟、監管調查以及企業客戶對資料隱私的擔憂持續升溫。微軟自身作為 OpenAI 的主要投資方和基礎設施提供商,其 CEO 公開指出合作伙伴的做法存在問題,這一姿態本身也反映出 AI 產業內部在商業模式和倫理標準上的分歧正在加劇。

對於關注 AI 產業的投資者而言,這一討論可能影響未來企業級 AI 服務的採購決策和監管走向。如果更多企業採納納德拉的建議,尋求自建或租用獨立的學習基礎設施,可能會進一步推高對雲算力和專用 AI 訓練環境的需求,同時改變模型提供商與雲平台之間的價值分配格局。