OpenAI正在扩充其GPT-6世代的产品线。继本月早些时候推出被其称为迄今最强、在编程与计算机操作等多项任务上表现最好的GPT-6 Astra之后,该公司又发布了更小体量的SolLuna的更新版本。OpenAI在公告中表示,Astra带来了新一代智能水平,而这两款模型的作用是让这种智能变得更高效、更易获得。

Sol与Luna并非全新名字。这两个系列最早在今年早些时候亮相,代表OpenAI模型体系中的不同层级:Sol面向编程等复杂任务,Luna则更适合事务性工作,OpenAI将其描述为「目标明确、量大高频的任务」,例如总结文档、提取信息或回答快速提问。此次更新相当于把Astra一代的能力向下渗透到这两个更轻量的档位。

价格是本次发布最受关注的部分。OpenAI称,6系列模型的API调用成本仅为上一代5.6系列Sol与Luna的一半。公司把这一降价归因于缓存与推理环节的改进。对于大量调用模型的企业客户而言,单位成本的下降往往比单纯的性能提升更能影响实际部署规模,因为它直接改变了哪些场景在经济上变得可行。

在准确性方面,OpenAI声称新模型给出的答案在事实层面更可靠,编程场景下的错误率也更低。公告提到,其内部事实性评测基于经过脱敏的真实对话,这些对话中用户曾标记模型出错;在这一评测上,GPT-6 Sol的错误量约为前代的一半,从而以低得多的成本达到了接近Astra的可靠性水平。

与以往发布一样,OpenAI也把新模型与主要竞争对手Anthropic做了对比,多次声称Sol与Luna在任务处理上明显优于Anthropic的旗舰模型,如FableOpus。值得注意的是,Anthropic在OpenAI发布前约90分钟刚刚推出了Opus 5.5的新版本,两家公司在发布节奏上的贴身竞争由此可见一斑。

可用性方面,新版Sol与Luna已面向多数付费账户上线ChatGPT WorkCodex,同时接入ChatGPT API;Luna还会出现在桌面应用中,并向Free与Go用户开放。OpenAI预计将在当天内逐步把这两款模型推送到ChatGPT的应用与网页端。

从产业角度看,这次发布延续了大模型厂商近来的共同方向:不再只比拼单一榜单上的峰值能力,而是把旗舰级能力拆分成不同档位,用价格与效率去争夺开发者与企业预算。对下游应用层而言,API成本减半意味着同样预算可以支撑更高的调用量或更复杂的流程;对上游算力与云服务而言,更高效的推理与缓存技术则可能改变单位token所对应的算力消耗结构。竞争层面,OpenAI与Anthropic在数小时内接连发布,说明头部实验室的产品迭代周期已被压缩到以周甚至以天计,模型选型的窗口期也随之缩短。