DeepSeek 於 8 月 13 日宣佈將其旗艦模型 V4 Pro 從預覽版升級為正式版,同時開源其智慧體軟體 DeepSeek Harness,並公佈新的 API 定價方案。新版模型在多個智慧體基準測試中表現顯著提升,但綜合能力仍與頭部模型存在差距。
V4 Pro 正式版的模型名稱、引數量和 100 萬 token 上下文視窗均未改變,官方表示現有整合無需任何調整即可繼續執行。在應用和網頁端,該模型以“專家模式”提供,並新增了對 OpenAI Responses API 的原生支援,可與 Codex 整合。推理強度可設定為“低”“高”“最大”三檔,DeepSeek 推薦日常智慧體使用中間檔。
據 DeepSeek 自有的對比資料,新版 V4 Pro 在 Terminal Bench 2.1 上的得分從 72.1 升至 87.9,DeepSWE 得分從 12.8 躍升至 62.7。在多項智慧體基準測試中,該模型超越了 Claude Opus 4.8。第三方評測機構 Artificial Analysis 也驗證了其進步,但指出 V4 Pro 的智慧指數從 45 升至 53,與 GLM-5.2 持平,仍落後於 Muse Spark(57)、Qwen 3.8 Max(58)、Kimi K3(60)和 Claude Opus 5(63)。DeepSeek 尚未公佈新版的權重檔案,4 月的預覽版仍託管在 Hugging Face 上。
此次更新也被視為對較小模型 V4 Flash 逼近旗艦的回應。7 月底,DeepSeek 釋出了 V4 Flash 的 0731 更新,其在 Artificial Analysis 智慧指數上幾乎與 Pro 預覽版持平,而價格卻低得多。
開源智慧體軟體 DeepSeek Harness v0.1 以開發者預覽版形式釋出,採用 MIT 許可證。該軟體被定位為 OpenAI Codex 和 Claude 的替代方案,基於新發布的 Cordis 外掛系統構建,所有功能(從工具、沙箱到會話和 UI)均為可替換的外掛。它提供連續會話日誌,記錄每次提示、工具呼叫和結果,支援恢復、分支和重放。極簡模式僅保留 shell 和檔案編輯器,DeepSeek 自身也使用該配置進行基準測試。軟體通過 npx 啟動本地 Web 介面,但官方警告存在相容性問題。專案由崔天翼領導,他於 2026 年 3 月從量化交易公司 Jane Street 加入 DeepSeek。8 月初團隊招募測試者時,三天內就有 712 個專案報名。
API 定價調整自 8 月 16 日 16:00 UTC 生效,採用峰谷計費。非高峰時段(中國工作時間之外)V4 Pro 輸入價格從每百萬 token 0.435 美元漲至 0.66 美元,輸出從 0.87 美元漲至 1.98 美元;高峰時段(UTC 1:00-4:00 和 6:00-10:00)價格翻倍,分別為 1.32 美元和 3.96 美元。快取命中價格漲幅最大,從 0.003625 美元漲至非高峰 0.022 美元、高峰 0.044 美元,緩存摺扣從常規輸入價的約 1/120 縮小至 1/30。對於反覆讀取相同檔案的智慧體工作流,這是成本增加最顯著的部分。此次漲價部分抵消了 5 月的降價,快取命中價格甚至高於降價前水平。
DeepSeek 在漲價的同時正在籌集新資金並籌備首次公開募股。此次調整反映了公司在商業化與成本控制之間的平衡,也對依賴其 API 的開發者構成成本壓力。