OpenAI正在擴充其GPT-6世代的產品線。繼本月早些時候推出被其稱為迄今最強、在程式設計與計算機操作等多項任務上表現最好的GPT-6 Astra之後,該公司又釋出了更小體量的SolLuna的更新版本。OpenAI在公告中表示,Astra帶來了新一代智慧水平,而這兩款模型的作用是讓這種智慧變得更高效、更易獲得。

Sol與Luna並非全新名字。這兩個系列最早在今年早些時候亮相,代表OpenAI模型體系中的不同層級:Sol面向程式設計等複雜任務,Luna則更適合事務性工作,OpenAI將其描述為「目標明確、量大高頻的任務」,例如總結文件、提取資訊或回答快速提問。此次更新相當於把Astra一代的能力向下滲透到這兩個更輕量的檔位。

價格是本次釋出最受關注的部分。OpenAI稱,6系列模型的API呼叫成本僅為上一代5.6系列Sol與Luna的一半。公司把這一降價歸因於快取與推理環節的改進。對於大量呼叫模型的企業客戶而言,單位成本的下降往往比單純的效能提升更能影響實際部署規模,因為它直接改變了哪些場景在經濟上變得可行。

在準確性方面,OpenAI聲稱新模型給出的答案在事實層面更可靠,程式設計場景下的錯誤率也更低。公告提到,其內部事實性評測基於經過脫敏的真實對話,這些對話中使用者曾標記模型出錯;在這一評測上,GPT-6 Sol的錯誤量約為前代的一半,從而以低得多的成本達到了接近Astra的可靠性水平。

與以往釋出一樣,OpenAI也把新模型與主要競爭對手Anthropic做了對比,多次聲稱Sol與Luna在任務處理上明顯優於Anthropic的旗艦模型,如FableOpus。值得注意的是,Anthropic在OpenAI釋出前約90分鐘剛剛推出了Opus 5.5的新版本,兩家公司在釋出節奏上的貼身競爭由此可見一斑。

可用性方面,新版Sol與Luna已面向多數付費賬戶上線ChatGPT WorkCodex,同時接入ChatGPT API;Luna還會出現在桌面應用中,並向Free與Go使用者開放。OpenAI預計將在當天內逐步把這兩款模型推送到ChatGPT的應用與網頁端。

從產業角度看,這次釋出延續了大模型廠商近來的共同方向:不再只比拼單一榜單上的峰值能力,而是把旗艦級能力拆分成不同檔位,用價格與效率去爭奪開發者與企業預算。對下游應用層而言,API成本減半意味著同樣預算可以支撐更高的呼叫量或更復雜的流程;對上游算力與雲服務而言,更高效的推理與快取技術則可能改變單位token所對應的算力消耗結構。競爭層面,OpenAI與Anthropic在數小時內接連發布,說明頭部實驗室的產品迭代週期已被壓縮到以周甚至以天計,模型選型的視窗期也隨之縮短。