Anthropic 於近日釋出公告,宣佈對其旗艦模型 Claude Fable 5 的生物安全防護機制進行重要更新,核心目標是大幅降低誤報率。據公司測試,此次更新使生物相關查詢的“回退”現象減少約 85%,即使用者在提出生物類問題後,系統切換到能力較弱模型的頻率顯著下降。這意味著 Fable 5 現在能夠處理更廣泛的生物任務,使用者在日常健康諮詢、教育場景以及臨床輔助等方面將獲得更連貫的體驗。
所謂“回退”,是指當安全分類器判定使用者請求涉及受保護內容時,模型會將請求轉交給能力較低的 Opus 5 處理。此前,由於 Fable 5 在生物領域能力突出,公司出於安全考量,幾乎遮蔽了所有生物查詢,導致大量合法使用者遭遇誤報。此次更新通過重新編寫分類器的“章程”,並經過數週的迭代調優,在保持安全性的同時顯著減少了誤報。Anthropic 表示,這一改進使 Fable 5 能夠更好地支援醫療專業人員處理臨床任務,也能幫助普通使用者理解化驗結果、症狀等日常健康問題。
然而,安全防護並未全面放開。對於涉及 病毒學、毒理學、分子設計 等被視為“雙重用途”的請求,Fable 5 仍會回退至 Opus 5,因此目前尚不能用於專業的生物學研究或藥物開發。Anthropic 強調,他們正致力於通過“可信訪問路徑”向前沿生物能力開放,以縮小這一差距。公司認為,AI 對世界產生積極影響的最大機會在於生物學和醫學領域,因此正在大力投資,以負責任的方式為生物學家提供前沿訪問許可權。
此次更新的背景是,Fable 5 在部分高度複雜的生物任務上已能超越專家水平,這既帶來了巨大的科研助力,也引發了安全擔憂。Anthropic 的能力評估顯示,該模型可能為惡意行為者提供顯著的能力提升,例如用於開發生物武器。美國情報界《2026 年度威脅評估》也指出,合成生物學和基因組編輯等生物技術進展可能帶來新的生物威脅,且多個國家行為體可能維持著進攻性生物和化學武器計劃。
為了應對這些風險,Anthropic 在釋出 Fable 5 時採取了保守策略,幾乎遮蔽所有生物查詢,以避免模型被濫用。公司承認,這一權衡在短期內給合法使用者帶來了不便,但鑑於生物領域濫用可能造成的災難性後果,他們認為這是必要的。此次更新是在安全與可用性之間尋求更好平衡的嘗試,通過最佳化分類器,減少誤報,同時保持對高風險請求的攔截。
從產業角度看,這一動態反映了前沿 AI 模型在垂直領域(尤其是醫療和生物科技)落地的現實挑戰:如何在釋放強大能力的同時,防範潛在風險。Anthropic 的做法為行業提供了參考,即通過精細化的安全分類器和可信訪問機制,逐步擴大模型的應用範圍。對於投資者而言,這意味著 AI 在生物醫藥領域的商業化程序可能加速,但監管和安全審查仍是不可忽視的變數。