OpenAIAnthropic 在同一天各自发布了一款更便宜的人工智能模型,这是两家前沿实验室自行业内部出现“放缓开发”呼声以来的首次新品发布。

OpenAI 为 GPT-6 家族新增了两个档位:GPT-6 SolGPT-6 Luna。据公司介绍,这两款模型的 API 价格较 GPT-5.6 的促销价下调了 50%。其中 Sol 定位低于 Astra,面向编程等更复杂的工作负载;Luna 则针对信息提取、文档摘要这类高并发、大批量的任务。

Anthropic 同日推出 Claude Opus 5.5,属于新的 Claude 5.5 模型家族。公司称这一版本在 token 使用上更高效,运行成本比 Opus 5 低约 40%。Anthropic 研究与实验室产品管理负责人 Dianne Penn 在接受 CNBC 采访时表示,团队持续投入的方向之一,是让模型的“思考”和“作答”过程更高效,从而根据用户设定的 effort 档位消耗更少 token。

两家公司此次动作,直接指向客户对成本效益的诉求。随着企业开始收紧 AI 相关支出,它们更倾向于选择单位成本更低的模型;与此同时,来自低价开源权重模型的竞争正在加剧,其中包括中国公司 阿里巴巴月之暗面DeepSeek 提供的产品。对前沿实验室而言,维持高价闭源模型的定价空间正受到挤压。

值得注意的是发布时点的微妙之处。Anthropic CEO Dario Amodei 此前呼吁全行业放缓先进 AI 的开发节奏,围绕模型安全的争论在近几周升温。这场争论的导火索之一,是前 Anthropic 研究员 Jacob Coxon9 月 8 日在 X 上发文称自己已辞职,并警告两家实验室是在“拿我们的生命赌博”。OpenAI CEO Sam Altman 以及特斯拉与 SpaceX CEO Elon Musk 也加入了 Amodei 的呼吁。

从产业角度看,这次发布传递出的信号是:在安全争论尚未平息的同时,商业竞争并未减速,只是竞争维度发生了位移——从“谁的能力上限更高”转向“谁能在同等能力下把每次调用的成本压得更低”。对下游应用开发者来说,API 价格下调和 token 效率提升意味着同样的预算可以支撑更多调用量,有利于智能体、文档处理、客服自动化等高频场景的铺开。

对上游算力与云基础设施而言,影响则更为复杂。单位推理成本下降通常会刺激调用量增长,从而在总量上支撑算力需求;但如果效率提升快于用量增长,单次请求对应的算力消耗会被摊薄,云厂商的推理收入结构也会随之变化。开源权重模型的持续施压,则让闭源厂商在定价上更难维持溢价,模型层的毛利率面临重新定价的可能。

目前尚不清楚这两款新模型在基准测试中的具体表现,以及它们与各自家族中更高档位产品的能力差距。可以确定的是,在客户控费与开源竞争的双重压力下,前沿实验室正把“更便宜”摆到与“更聪明”同等重要的位置。