Anthropic 兩位強化學習方向的技術負責人 Nicholas Marwell 與 Sholto Douglas 在一檔播客中,系統談到了 AGI 時間表、AI 程式設計的演進、開源與監管立場,以及他們為何反對模型蒸餾。這場對話釋出一個多月後,Anthropic 披露的 IPO 申報檔案讓其中的判斷有了更具體的註腳。

檔案顯示,2025 年 Anthropic 營收接近 46 億美元,同比增長約 12 倍,但經營虧損仍超過 80 億美元;公司已為未來的雲、算力和基礎設施簽下至少 5180 億美元的長期承諾。若上市順利,其估值最高可能超過 2 萬億美元。融資與採購也開始相互纏繞:Broadcom 同意向 Anthropic 提供最高 420 億美元貸款融資用於基礎設施支出,而 Anthropic 承諾未來 5 年投入 1252 億美元租用 TPU 算力。

這種「收入數十億、承諾數千億」的結構,對應 Marwell 在訪談中給出的內部邏輯:每增加一個邊際單位的智慧,其創造的經濟價值可能比前一個單位呈指數級增長。他用程式設計場景解釋這一判斷——Tab 自動補全已幾乎不值錢,隨後出現了智慧體式程式設計,再往後可能是能獨立完成軟體工程工作的 AI,最終延伸到數學發現、生命科學乃至疾病治療。舊能力會迅速商品化,但只要智慧前沿繼續移動,最前沿的那一點能力反而可能越來越昂貴。

兩位技術負責人對 AGI 的時間判斷相當激進。他們認為未來幾年就可能出現能力達到或超過所有人類的模型,能夠完成人類在電腦上可完成的所有事情,並在機器人技術足夠先進後延伸到物理世界。Douglas 以自身經歷描述變化速度:18 個月前他還在逐行手寫程式碼,加入 Anthropic 幾個月後轉為「指導模型」寫程式碼,如今已可讓模型獨立完成一兩天的工作並真正推進專案,感覺像多了一個初級團隊成員。Marwell 則補充,模型開發此前主要是讓 AI 完成人類本就擅長的任務,而近期數學領域的部分結果開始顯示,模型能把不同的人類想法組合起來,形成此前未出現過的新思路。

在更近期的風險上,兩人列出失業、生物安全與網路安全三類擔憂,並認為這些並非遙遠未來。Douglas 判斷,網路安全與生物領域目前攻擊方佔優,但未來兩年網路安全可能轉為防禦佔優——因為可以提前用足夠強的智慧攻擊自己的系統、補上漏洞。

關於開源,Marwell 表示個人非常支援開源,自己當年學習機器學習就受益於開源模型,但認為風險會越來越大,因此主張設定閾值,決定社會整體願意釋放多強的能力,封閉模型與開源模型應滿足同樣的安全門檻。

在中美 AI 競賽問題上,Douglas 的表述相當直接:在任何可接受的情形下,都不會出現「美國放慢、中國繼續前進」的結果;任何真正的放緩方案都必須是完全協調的,且各方都值得信任,基本不存在美國單獨放慢的情形。

兩人反對蒸餾的理由則與商業模式直接相關。他們認為蒸餾只能複製當前前沿,無法把研發推進到下一代;進入下一代前沿需要鉅額前期資本投入,未來一次訓練執行的成本可能是 100 億、1000 億甚至 1 萬億美元。如果他人能以很小成本複製成果並在一兩週內推出複製品,複製方在經濟上反而更有優勢,因為它不必承擔那筆巨大的研發成本。

這也回到 IPO 檔案呈現的另一重矛盾:Anthropic 一邊向資本市場描繪 AI 比工業化、電力和網際網路更深刻的經濟變革,一邊在風險提示中警告先進 AI 可能帶來災難性甚至生存性風險,包括模型抗拒關閉、隱藏資訊等難以預料的自主行為。Marwell 對此的回應是,稍微落後於前沿的一側會不斷商品化,但真正的領先邊緣價值反而會越來越大。

訪談最後,兩人把目標描述為把原本可能需要數百年的技術進步壓縮到未來一二十年完成,最終進入一個幾乎所有東西的成本都壓縮到能源成本的後稀缺世界。這一願景能否支撐起 2 萬億美元級別的估值,仍取決於前沿能力能否持續領先、以及數千億美元算力承諾能否轉化為對應的收入。