Anthropic於9月7日美國勞動節前突然釋出兩款新模型:面向普通使用者和企業的Fable 5.1,以及面向經過驗證的網路安全和生命科學機構的Mythos 5.1。兩款模型共享同一套前沿能力,僅在安全限制上有所區別。此次釋出被普遍視為Anthropic在公開遞表前的最後一次重量級模型展示,公司計劃在勞動節後公開IPO招股書,並最快於9月底至10月初上市。
從規格上看,Fable 5.1延續了Fable 5的100萬Token上下文視窗和128K最大輸出,基礎價格保持不變:每百萬輸入Token 10美元,每百萬輸出Token 50美元。但快取讀取價格從每百萬Token 1美元大幅下調至0.25美元,降幅達75%。這一調整對長時執行的Agent任務影響顯著,因為Agent會反覆讀取系統提示、程式碼庫和工具定義,快取讀取成本佔比隨任務時長和工具呼叫次數增加而上升。Anthropic基於8月實際使用資料測算,典型工作負載從Fable 5切換到5.1後整體成本預計下降約25%,複雜Coding和高度Agent化任務降幅最高可達45%。
效能提升同樣集中在長時間、多步驟的Agent任務上。在Terminal-Bench-Science 0.1基準中,Fable 5.1得分從24.7%躍升至52.6%,實現翻倍;Terminal-Bench 4.0從42.0%提升至55.8%;AutomationBench從17.1%提升至31.4%。相比之下,傳統推理和Coding基準的提升幅度較小,如Humanity's Last Exam不使用工具時從57.8%提升至60.9%,使用工具後從63.8%提升至65.0%。早期企業測試也印證了這一趨勢:Browserbase在瀏覽器Agent基準中,Fable 5.1完成任務率達82%,高於Opus 5的74%和Fable 5的57%;Ramp在一次測試中讓Fable 5.1無人干預連續執行38小時,模型自行發現並修正了機器學習實驗中的標籤偽影問題,還啟動了6組並行實驗;Canva則反饋Fable 5.1的文字表達更易理解,並在盲測中更偏好其輸出。
Mythos 5.1的釋出重點展示了科研能力。Anthropic讓Mythos 5.1設計蛋白質binder,在12個靶點上命中率接近50%,而常見命中率僅約10%至15%,其中三個靶點的結合親和力比Adaptyv Bio比賽最佳方案高出約10倍。此外,Fable 5.1利用NASA Magellan任務的雷達資料訓練神經網路,為約三分之一金星表面重新生成高解析度高程地圖,解析度從10-20公里提升至2-3公里,高度資料準確度最高提升約25%。Mythos 5.1還針對7個開源模型編寫定製GPU Kernel,將推理速度最高提升2.5倍,並計劃開源這些最佳化。
本次釋出還引入了更強的反蒸餾機制。Anthropic封堵了API使用者通過修改歷史上下文保留thinking記錄的做法,以防止外部模型批次收集推理軌跡進行蒸餾。同時推出的Enterprise Frontier Safeguards(EFS)允許企業將監控資料儲存在客戶控制的雲基礎設施中,而非Anthropic伺服器,以解決敏感資料長期儲存的顧慮。該機制與超過100家金融、醫療、製造等行業客戶共同開發,計劃秋季分階段上線。
值得注意的是,Anthropic此前調整了Claude Code的周額度政策。8月29日宣佈從9月14日起將標準周額度永久提高25%,但相對於使用者目前使用的臨時額度(提高50%),實際反而下降了約17%。這一變化在Fable 5.1釋出後引發使用者評論區的追問。
此次釋出的時間點與IPO計劃緊密相關。Anthropic已於6月秘密提交IPO檔案,計劃勞動節後公開招股書,9月中旬舉行投資者日,最快9月底至10月初上市。5月私募估值達9650億美元,8月投資者預計上市估值可能超過2萬億美元,部分投資者按30倍收入倍數估算達3萬億美元。這些估值預測基於公司年化收入年底可能達1000億至1200億美元的預期,但最終發行價格尚未確定。Fable 5.1的釋出正是向華爾街展示其技術實力和商業化潛力的關鍵一步。