Anthropic 于近日发布公告,宣布对其旗舰模型 Claude Fable 5 的生物安全防护机制进行重要更新,核心目标是大幅降低误报率。据公司测试,此次更新使生物相关查询的“回退”现象减少约 85%,即用户在提出生物类问题后,系统切换到能力较弱模型的频率显著下降。这意味着 Fable 5 现在能够处理更广泛的生物任务,用户在日常健康咨询、教育场景以及临床辅助等方面将获得更连贯的体验。
所谓“回退”,是指当安全分类器判定用户请求涉及受保护内容时,模型会将请求转交给能力较低的 Opus 5 处理。此前,由于 Fable 5 在生物领域能力突出,公司出于安全考量,几乎屏蔽了所有生物查询,导致大量合法用户遭遇误报。此次更新通过重新编写分类器的“章程”,并经过数周的迭代调优,在保持安全性的同时显著减少了误报。Anthropic 表示,这一改进使 Fable 5 能够更好地支持医疗专业人员处理临床任务,也能帮助普通用户理解化验结果、症状等日常健康问题。
然而,安全防护并未全面放开。对于涉及 病毒学、毒理学、分子设计 等被视为“双重用途”的请求,Fable 5 仍会回退至 Opus 5,因此目前尚不能用于专业的生物学研究或药物开发。Anthropic 强调,他们正致力于通过“可信访问路径”向前沿生物能力开放,以缩小这一差距。公司认为,AI 对世界产生积极影响的最大机会在于生物学和医学领域,因此正在大力投资,以负责任的方式为生物学家提供前沿访问权限。
此次更新的背景是,Fable 5 在部分高度复杂的生物任务上已能超越专家水平,这既带来了巨大的科研助力,也引发了安全担忧。Anthropic 的能力评估显示,该模型可能为恶意行为者提供显著的能力提升,例如用于开发生物武器。美国情报界《2026 年度威胁评估》也指出,合成生物学和基因组编辑等生物技术进展可能带来新的生物威胁,且多个国家行为体可能维持着进攻性生物和化学武器计划。
为了应对这些风险,Anthropic 在发布 Fable 5 时采取了保守策略,几乎屏蔽所有生物查询,以避免模型被滥用。公司承认,这一权衡在短期内给合法用户带来了不便,但鉴于生物领域滥用可能造成的灾难性后果,他们认为这是必要的。此次更新是在安全与可用性之间寻求更好平衡的尝试,通过优化分类器,减少误报,同时保持对高风险请求的拦截。
从产业角度看,这一动态反映了前沿 AI 模型在垂直领域(尤其是医疗和生物科技)落地的现实挑战:如何在释放强大能力的同时,防范潜在风险。Anthropic 的做法为行业提供了参考,即通过精细化的安全分类器和可信访问机制,逐步扩大模型的应用范围。对于投资者而言,这意味着 AI 在生物医药领域的商业化进程可能加速,但监管和安全审查仍是不可忽视的变量。