Anthropic于9月7日美国劳动节前突然发布两款新模型:面向普通用户和企业的Fable 5.1,以及面向经过验证的网络安全和生命科学机构的Mythos 5.1。两款模型共享同一套前沿能力,仅在安全限制上有所区别。此次发布被普遍视为Anthropic在公开递表前的最后一次重量级模型展示,公司计划在劳动节后公开IPO招股书,并最快于9月底至10月初上市。
从规格上看,Fable 5.1延续了Fable 5的100万Token上下文窗口和128K最大输出,基础价格保持不变:每百万输入Token 10美元,每百万输出Token 50美元。但缓存读取价格从每百万Token 1美元大幅下调至0.25美元,降幅达75%。这一调整对长时运行的Agent任务影响显著,因为Agent会反复读取系统提示、代码库和工具定义,缓存读取成本占比随任务时长和工具调用次数增加而上升。Anthropic基于8月实际使用数据测算,典型工作负载从Fable 5切换到5.1后整体成本预计下降约25%,复杂Coding和高度Agent化任务降幅最高可达45%。
性能提升同样集中在长时间、多步骤的Agent任务上。在Terminal-Bench-Science 0.1基准中,Fable 5.1得分从24.7%跃升至52.6%,实现翻倍;Terminal-Bench 4.0从42.0%提升至55.8%;AutomationBench从17.1%提升至31.4%。相比之下,传统推理和Coding基准的提升幅度较小,如Humanity's Last Exam不使用工具时从57.8%提升至60.9%,使用工具后从63.8%提升至65.0%。早期企业测试也印证了这一趋势:Browserbase在浏览器Agent基准中,Fable 5.1完成任务率达82%,高于Opus 5的74%和Fable 5的57%;Ramp在一次测试中让Fable 5.1无人干预连续运行38小时,模型自行发现并修正了机器学习实验中的标签伪影问题,还启动了6组并行实验;Canva则反馈Fable 5.1的文字表达更易理解,并在盲测中更偏好其输出。
Mythos 5.1的发布重点展示了科研能力。Anthropic让Mythos 5.1设计蛋白质binder,在12个靶点上命中率接近50%,而常见命中率仅约10%至15%,其中三个靶点的结合亲和力比Adaptyv Bio比赛最佳方案高出约10倍。此外,Fable 5.1利用NASA Magellan任务的雷达数据训练神经网络,为约三分之一金星表面重新生成高分辨率高程地图,分辨率从10-20公里提升至2-3公里,高度数据准确度最高提升约25%。Mythos 5.1还针对7个开源模型编写定制GPU Kernel,将推理速度最高提升2.5倍,并计划开源这些优化。
本次发布还引入了更强的反蒸馏机制。Anthropic封堵了API用户通过修改历史上下文保留thinking记录的做法,以防止外部模型批量收集推理轨迹进行蒸馏。同时推出的Enterprise Frontier Safeguards(EFS)允许企业将监控数据存储在客户控制的云基础设施中,而非Anthropic服务器,以解决敏感数据长期保存的顾虑。该机制与超过100家金融、医疗、制造等行业客户共同开发,计划秋季分阶段上线。
值得注意的是,Anthropic此前调整了Claude Code的周额度政策。8月29日宣布从9月14日起将标准周额度永久提高25%,但相对于用户目前使用的临时额度(提高50%),实际反而下降了约17%。这一变化在Fable 5.1发布后引发用户评论区的追问。
此次发布的时间点与IPO计划紧密相关。Anthropic已于6月秘密提交IPO文件,计划劳动节后公开招股书,9月中旬举行投资者日,最快9月底至10月初上市。5月私募估值达9650亿美元,8月投资者预计上市估值可能超过2万亿美元,部分投资者按30倍收入倍数估算达3万亿美元。这些估值预测基于公司年化收入年底可能达1000亿至1200亿美元的预期,但最终发行价格尚未确定。Fable 5.1的发布正是向华尔街展示其技术实力和商业化潜力的关键一步。