矽谷Tech news在鈦媒體發表的評論指出,全球AI巨頭正集體調整競爭策略,大模型領域的價格戰並未結束,而是進入了以“單任務成本”為新標尺的階段。
7月15日,馬斯克在X平台上平淡地表示“Grok 4.5不是最強的大模型,但它值得一試”。這句話背後,是SpaceX AI經歷的一個密集釋出期:6月12日,SpaceX以每股135美元、估值約1.77萬億美元登陸納斯達克,創下史上最大IPO,融資約750億美元;6月16日,宣佈以600億美元全股票收購AI程式設計工具Cursor;7月8日推出Grok 4.5;次日,OpenAI即釋出GPT-5.6。這種釋出節奏被解讀為蓄謀已久的競爭訊號。
比釋出密度更值得關注的是,巨頭們對模型的敘事方式正在集體轉向。Grok 4.5的API定價為輸入每百萬token 2美元、輸出每百萬token 6美元,對比Claude Opus 4.8的輸入5美元、輸出25美元和GPT-5.6 Sol的輸入5美元、輸出30美元,價格不到對方的四分之一到五分之一。xAI還宣稱Grok 4.5的token效率是同類模型的兩倍,在SWE-Bench Pro測試中平均每任務消耗約1.6萬個輸出token,而Opus 4.8需要約6.7萬個,差距超過4倍。但OpenAI並未坐視,其GPT-5.6 Luna定價輸入1美元、輸出6美元,輸入端比Grok 4.5還便宜一半。
競爭邏輯正從“誰的模型最強”轉向“誰的模型能在真實場景中最划算地完成任務”。xAI官方基準測試顯示,Grok 4.5在Artificial Analysis Intelligence Index中以54分排名第四,並非最強。但它選擇了一條不同路徑:通過與Cursor的深度聯合訓練,獨家消化了萬億級Token的開發者真實互動資料,包括頂尖程式設計師寫程式碼時的回刪、報錯跳轉等實戰經驗,這是任何公開資料集都無法提供的。
橫向對比,三家巨頭走出了三條不同的路。OpenAI的GPT-5.6用Sol/Terra/Luna三級命名取代了“旗艦+mini/nano”體系,讓能力跟著場景走、成本跟著任務變,並推出了跨應用自動化智慧體平台ChatGPT Work。Anthropic在6月底釋出的Claude Sonnet 5則內建了effort機制,呼叫方可根據任務複雜度調節推理強度,打破了“選定模型就鎖定成本”的舊邏輯。三家的共同指向很清楚:競爭焦點已從模型能力排名轉向真實場景下的價效比。
當模型進入真實任務場景,一個反直覺的結論浮出水面:定價便宜的模型,未必真的便宜。據Coding Agent Index資料,Grok 4.5在Grok Build中每個任務平均花費2.49美元,而GPT-5.6 Sol在Codex中需要5.07美元,Claude Fable 5在Claude Code中需要11.80美元,差距接近5倍。價效比的衡量單位從“token單價”變成了“單任務成本”。這一趨勢在國內同樣明顯,DeepSeek-V4-Flash、Qwen3-235B-A22B、Kimi K2.6等集體押注“大引數+小啟用”的MoE架構。馬斯克還透露,xAI尚未部署內部開發的C/C++推理棧,一旦部署速度預計翻倍以上,意味著Grok 4.5的成本還有進一步下降空間。
雲平台也在產品化這一趨勢。Amazon Bedrock推出Intelligent Prompt Routing,微軟Azure AI Foundry上線Model Router,Google宣佈Chrome瀏覽器將進一步整合Gemini AI。未來很多呼叫未必由終端使用者直接決定,而是由雲平台和框架提前分配。Grok 4.5與Cursor的組合正是這一邏輯的縮影,但隱患同樣存在:Cursor在AI程式設計工具市場的份額已從2025年6月的41%下降到2026年5月的26%,Anthropic控制了這個類別的一半。如果Cursor的使用者基礎持續收縮,Grok 4.5的資料飛輪能轉多久?
馬斯克做生意的底層邏輯,始終是用成本結構顛覆現有格局。SpaceX AI擁有Colossus超級計算機,正在向包括Anthropic和Google在內的競爭對手出租算力。據Axios報道,Grok 4.5的訓練使用了與出租給競爭對手相同的算力資源,形成了“對手付錢幫馬斯克訓練模型”的奇特局面。但擴張的另一面是代價:7月15日路透社披露,xAI位於田納西州的Colossus 2資料中心違規安裝了59台天然氣渦輪機,未獲環境許可。
更大的風暴在模型釋出一週後襲來。7月13日,獨立安全研究員發現Grok Build CLI會在使用者不知情的情況下,將整個Git倉庫打包上傳至xAI的谷歌雲端儲存桶。沉默兩天後,馬斯克承認屬實,承諾所有資料“一個位元組不留”徹底刪除,並上線/privacy命令。7月15日,SpaceX AI宣佈開源Grok Build,將原始碼釋出至GitHub,並重置所有使用者使用限制。從“偷偷上傳”到“全部開源”再到“資料清零”,這一系列動作只用了48小時。但Grok 4.5的獨家賣點恰恰是“收集開發者的認知行為資料”,當行為資料從聯合訓練的協議內容變成悄無聲息的後台上傳,信任的邊介面臨考驗。
評論最後指出,大模型正在接近自己的“傑文斯時刻”:效率提升沒有抑制使用,反而降低了使用門檻,導致AI使用密度上升。7月15日,Anthropic被曝加速推進IPO,估值已達9650億美元,首次超過OpenAI成為全球估值最高的未上市AI公司。市場對這種密度上升正在提前定價,但前提是使用者得知道自己的資料去了哪裡。