OpenAI兌現了「連續28天釋出或重置」承諾的第一天動作:提速。公司高管Tibo宣佈,訂閱使用者在所有產品中使用GPT-6 Astra和GPT-6.1 Sol時,預設速度提升約50%,使用者無需任何操作,兩小時內即可感受到變化。他隨後補充了具體數字:輸出速度從30 TPS提升到50 TPS,並搭配了其稱為目前最佳化程度最高的tokenizer。

這次提速不只覆蓋OpenAI自家產品,也包括所有通過「Sign in with ChatGPT」接入的合作伙伴,Tibo點名了OpenCode、Pi、Amp、Devin等。也就是說,只要用ChatGPT訂閱跑這兩個模型,無論在哪裡呼叫都會變快。OpenAI官方還同步宣佈了文本水印功能。

不過,開發者社群的反饋並不全是掌聲。有開發者在評論區表示,即便如此,ChatGPT模型依然比Claude慢;還有人曬出實測資料質疑,稱GPT-6.1的速度不過是回到了該模型釋出時的水平。

就在提速訊息釋出的幾乎同一時間,第三方機構SemiAnalysis釋出了一份訂閱實測報告,標題直白:Anthropic訂閱提供的價值是OpenAI的5倍以上。這份報告對Anthropic、OpenAI、Meta、SpaceXAI、MiniMax、月之暗面、智譜、Cursor和Cognition的訂閱方案逐一做了極限測試。

SemiAnalysis的方法是把輸入、快取寫入、快取讀取、輸出四類token逐一隔離,用專門設計的prompt反覆呼叫,記錄用量進度條每跳一格消耗多少token,直到誤差收斂到±5%以內,再按API價格折算,得出每份訂閱的「API等價價值」。報告還發現,同一家廠商的三個相同訂閱裡,有一個賬號的額度比另外兩個低約20%,與廠商溝通後確認該賬號被分進了一個規模極小的額度A/B測試——這說明廠商可以隨時、靜默地調整訂閱額度。

先看旗艦檔。GPT-6 Astra和Claude Fable 5.1的額度其實相當接近,區別在於Fable在Claude訂閱中最多隻能佔用總額度的一半。在200美元檔位上,用掉價值2485美元的Fable 5.1之後,Claude訂閱還剩一半額度可以留給其他模型;同檔OpenAI訂閱在消耗完價值2897美元的Astra後,就徹底見底。

真正拉開差距的是中檔模型,也就是兩家都定位為大多數使用者「日常主力」的Claude Opus 5.5和GPT-6.1 Sol。在這一層級,Anthropic訂閱的API等價價值約為OpenAI的5倍,並且在各個價位檔全面領先。有人會說,這樣比對OpenAI不公平:6.1 Sol的API單價本就比Opus 5.5便宜得多,按API價格折算自然吃虧。SemiAnalysis預判了這個質疑,即便改為直接比較token數量,差距依然很大。

OpenAI能拿出來的唯一反駁,是它的Pro套餐沒有5小時限制,使用者更容易把月度額度真正用滿。但SemiAnalysis認為,這不足以抵消Opus 5.5在Claude訂閱上約4倍的價值優勢。報告判斷:獨立開發者過去常常稱讚OpenAI的訂閱額度比Anthropic慷慨,這個說法如今已經不成立了。

差距之所以這麼大,很大程度上來自OpenAI上週的那次調整。SemiAnalysis的追蹤資料證實了Tibo此前宣佈的變化:OpenAI 200美元套餐的API等價價值被砍掉一半——每個模型檔位可用的token數量都減半;又因為GPT-6.1 Sol同時下調了快取輸入價格,Sol級模型的API等價價值跌幅超過50%。降額前購買的200美元套餐可以保留舊額度到10月29日,新購使用者則立即適用新額度。

同期推出的500美元新檔位,Astra額度只比舊版200美元套餐多21%,Sol級模型的API等價價值甚至不升反降。這一檔真正的賣點是300 TPS的Ultrafast模式,SemiAnalysis表示其額度仍在測試中。在此之前,200美元檔是OpenAI補貼力度最大的套餐。按每美元價值計算,Pro 100在Astra上約為Plus的2倍,Pro 200又在Pro 100的基礎上再翻一倍。調整之後,Pro 100、200和500三檔每美元能換到的token完全一致,「買大檔更划算」的邏輯不復存在。

為什麼要收緊訂閱?SemiAnalysis算了一筆賬。訂閱是高度補貼的產品,以Anthropic為例,據估算,訂閱只佔總收入的約10%,卻可能吃掉40%以上的推理算力,讓每兆瓦的混合收入減少約3600萬美元。對訂閱收入佔比更高的OpenAI來說,這個問題只會更突出。

兩家都想降低補貼,路徑卻截然不同。Anthropic走的是漸進路線:越高階的模型,訂閱裡給的API等價價值越低。Sonnet 5.5與Opus 5.5之間差距不大,到了Fable 5.1則明顯收縮。SemiAnalysis測算,在100%使用率、API毛利率92%的假設下,用滿Opus 5.5對應的訂閱毛利率是-369%,用滿Fable 5.1約為1%;如果按更現實的20%平均使用率計算,兩者分別為6%和80%。換句話說,如果所有人只用Fable,Anthropic的訂閱業務很可能已經擁有軟體公司級別的利潤率。

OpenAI選的則是被SemiAnalysis稱為「核選項」的做法:直接把所有模型的額度一刀切,降到Fable級別。按理說,這種做法應該招致強烈反彈,但SemiAnalysis認為OpenAI在很大程度上躲過了這一劫,可能的原因是開發者日的大量正面宣傳沖淡了前一天的降額訊息,加上老使用者還能多保留一個月舊額度。只是從這幾天社交媒體上的情緒來看,這次「躲過」也許只是推遲。

第1天的提速是實打實的改進。Tibo也給出了OpenAI自己的辯護邏輯:模型完成任務需要的token更少,單比token數量或API等價價值,並不能完全反映實際產出。這個論點有一定道理,SemiAnalysis自己也承認,當某個模型按API價格看特別貴或特別便宜時,API等價價值會失真。但「每個任務能省多少token」目前還沒有第三方的量化資料,而額度減半已經是被測出來的事實。

還有一個時間點需要留意:降額前購買的200美元套餐,舊額度將在10月29日到期,正好落在這28天的視窗期內。到那時,此前被「保護」起來的一批重度使用者,也會直接感受到額度的變化。

訂閱額度之爭從來不只是成本問題,也是一場使用者爭奪戰。SemiAnalysis在報告開頭提到,OpenAI此前幾次慷慨的額度重置,是Codex近期使用者激增的重要原因之一,Anthropic也因此多次收回原定的訂閱降額計劃。如今,情況已然開始變化。