DeepSeek 本周开源了名为 Harness 的智能体构建框架,并同步发布了旗舰模型 V4-Pro-0813。与以往聚焦于基础模型不同,此次 DeepSeek 将重心放在了模型之外的“中间层”——决定智能体能否真正完成任务的软件集合。Harness 采用 MIT 许可,允许开发者自由修改模型、工具、存储等组件,甚至可接入竞争对手的模型,这标志着 DeepSeek 从“模型搅局者”向“平台提供者”的转变。
Harness 被 DeepSeek 称为“开发者预览版”,其设计理念是“智能体构建套件”而非成品智能体。它支持打开代码仓库、编辑文件、运行 shell 命令、搜索网页、制定可执行计划,并能将任务分派给其他智能体。更重要的是,Harness 会记录工具调用、结果和模型交互,开发者可以回溯会话,甚至从之前的某个节点分叉继续。这种设计解决了智能体在长任务中“失忆”或“跑偏”的痛点。
值得注意的是,Harness 并不强制使用 DeepSeek 自家的模型——模型本身也是插件。这意味着开发者可以轻松地将其他厂商的模型嵌入 Harness,这在此前以模型性能著称的 DeepSeek 身上颇为罕见。DeepSeek 还警告称,未来将会有破坏兼容性的变更,但未透露具体时间。
与 Harness 一同发布的 V4-Pro-0813 在官方基准测试中表现亮眼:在 Terminal Bench 2.1 上得分 87.9,在 Toolathlon-Verified 上得分 74.1,在 DSBench-FullStack 上得分 71.1,在 DSBench-Hard 上得分 67.2。这些成绩由 DeepSeek 自行公布,且部分公共编码智能体测试是在 Harness 最小模式下运行的,表明 Harness 已深度融入其模型测试流程。
回顾去年年初,DeepSeek 曾凭借高性价比的模型引发市场震动,导致芯片股受挫、行业对 AI 投资产生质疑。如今,DeepSeek 再次以开源框架切入智能体赛道,其 MIT 许可策略可能吸引大量开发者采用,从而在模型层与应用层之间建立起新的生态。对于依赖专有智能体框架的厂商而言,Harness 的出现可能带来竞争压力,同时也为整个 AI 产业链提供了更多元化的选择。