DeepSeek 于 8 月 13 日宣布将其旗舰模型 V4 Pro 从预览版升级为正式版,同时开源其智能体软件 DeepSeek Harness,并公布新的 API 定价方案。新版模型在多个智能体基准测试中表现显著提升,但综合能力仍与头部模型存在差距。
V4 Pro 正式版的模型名称、参数量和 100 万 token 上下文窗口均未改变,官方表示现有集成无需任何调整即可继续运行。在应用和网页端,该模型以“专家模式”提供,并新增了对 OpenAI Responses API 的原生支持,可与 Codex 集成。推理强度可设置为“低”“高”“最大”三档,DeepSeek 推荐日常智能体使用中间档。
据 DeepSeek 自有的对比数据,新版 V4 Pro 在 Terminal Bench 2.1 上的得分从 72.1 升至 87.9,DeepSWE 得分从 12.8 跃升至 62.7。在多项智能体基准测试中,该模型超越了 Claude Opus 4.8。第三方评测机构 Artificial Analysis 也验证了其进步,但指出 V4 Pro 的智能指数从 45 升至 53,与 GLM-5.2 持平,仍落后于 Muse Spark(57)、Qwen 3.8 Max(58)、Kimi K3(60)和 Claude Opus 5(63)。DeepSeek 尚未公布新版的权重文件,4 月的预览版仍托管在 Hugging Face 上。
此次更新也被视为对较小模型 V4 Flash 逼近旗舰的回应。7 月底,DeepSeek 发布了 V4 Flash 的 0731 更新,其在 Artificial Analysis 智能指数上几乎与 Pro 预览版持平,而价格却低得多。
开源智能体软件 DeepSeek Harness v0.1 以开发者预览版形式发布,采用 MIT 许可证。该软件被定位为 OpenAI Codex 和 Claude 的替代方案,基于新发布的 Cordis 插件系统构建,所有功能(从工具、沙箱到会话和 UI)均为可替换的插件。它提供连续会话日志,记录每次提示、工具调用和结果,支持恢复、分支和重放。极简模式仅保留 shell 和文件编辑器,DeepSeek 自身也使用该配置进行基准测试。软件通过 npx 启动本地 Web 界面,但官方警告存在兼容性问题。项目由崔天翼领导,他于 2026 年 3 月从量化交易公司 Jane Street 加入 DeepSeek。8 月初团队招募测试者时,三天内就有 712 个项目报名。
API 定价调整自 8 月 16 日 16:00 UTC 生效,采用峰谷计费。非高峰时段(中国工作时间之外)V4 Pro 输入价格从每百万 token 0.435 美元涨至 0.66 美元,输出从 0.87 美元涨至 1.98 美元;高峰时段(UTC 1:00-4:00 和 6:00-10:00)价格翻倍,分别为 1.32 美元和 3.96 美元。缓存命中价格涨幅最大,从 0.003625 美元涨至非高峰 0.022 美元、高峰 0.044 美元,缓存折扣从常规输入价的约 1/120 缩小至 1/30。对于反复读取相同文件的智能体工作流,这是成本增加最显著的部分。此次涨价部分抵消了 5 月的降价,缓存命中价格甚至高于降价前水平。
DeepSeek 在涨价的同时正在筹集新资金并筹备首次公开募股。此次调整反映了公司在商业化与成本控制之间的平衡,也对依赖其 API 的开发者构成成本压力。