DeepSeek 于今日正式发布其首款 Agent 产品 DeepSeek Harness,标志着这家以模型见长的公司开始争夺模型输出之后的 Agent 执行层。该产品并非简单的“DeepSeek 版 Codex”,而是一套可重组、可回放的 Agent 运行时,允许开发者深度定制 Agent 的工具、提示词、上下文与界面。

早在 V4 Flash 正式版更新日志中,DeepSeek 就曾提及“正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness 极简模式(即将发布)作为框架进行测试”,暗示 Harness 与模型性能的关联。APPSO 在发布前获得内测资格,体验了其项目管理、长任务协作、多 Agent 编排、上下文管理、联网搜索及 Skill 等功能。

DeepSeek Harness 的核心特色在于 Agent 预设插件化架构。预设即一个会话中 Agent 所运行的插件组装,包含工具、提示词与能力。内置四种预设:极简模式(minimal) 用于简单修改与测试;标准模式(standard) 适合日常写代码、修 Bug;代码模式(code) 处理大批量搜索与多步骤自动处理;创造模式(cordis) 用于开发新的预设或插件。用户可通过“/”命令快速切换指令或 Skills,并支持自定义预设。

插件是 Harness 的重头戏,官方宣称“Everything is a plugin”。内测期间,用户已开发约 300 个插件,涵盖界面修改、桌面宠物、对话优化,甚至实现“跨会话长期记忆 + 后台自我进化”的纯插件方案。该记忆插件通过本地文件持久化、分层上下文注入与 LLM 自我整理实现,而非传统向量数据库 + RAG。插件还能实现模型自我进化,定期让 LLM 审视工作上下文,将临时经验压缩为长久知识。

从架构看,插件几乎覆盖模型、工具、策略、存储、上下文和界面等所有层面,均可替换或组合。DeepSeek Harness 还支持接入第三方大模型,默认提供方包括 KimiOpenAI、Anthropic、Google 等近 40 家 模型厂商。

实测中,APPSO 让 DeepSeek-V4-Flash 分别在 Harness、Reasonix 和 Codex 中完成同一 Three.js 滑沙游戏。Harness 版本几乎无 Bug,玩家全程滑行、穿过门抵达绿洲;而 V4 Pro 用时更长但表现稍逊。Reasonix 版本画面粗糙,Codex 版本则更明亮简单。单次案例虽不能证明 Harness 全面更强,但表明当模型相同时,执行层提供的工具、提示词、上下文组织和执行策略能显著改变最终产物。

DeepSeek Harness 的独特之处在于将 插件生命周期、Agent 能力组合、工具执行、会话日志、Web UI 接入同一套内核,并采用“模型可见 ⇔ 已记录”机制,保存完整事件流而非仅最终消息。上下文压缩也不会删除原始历史,而是用 replacement 事件改变模型所见。此外,所有工具共用一条执行内核,模型可编写 TypeScript 编排多个工具调用,中间数据留在运行环境,仅最终结果进入模型上下文。

前端界面本身也是第二棵插件树,应用启动后加载 UI 插件,各插件注册到标准挂载位。这种设计让用户不再局限于通用 Agent,而是可以自行组装属于自己的 Agent。

DeepSeek 过去最受关注的是模型本身,如今 Harness 开始处理模型之外的问题:如何组织工具和上下文、保存执行过程,以及在同一套系统中配置不同 Agent。这或许意味着,Agent 和模型同样将成为基础设施,开发者和用户可以利用 Harness 创造出无数个 Codex,而真正属于自己的 Agent 也可以由自己组装出来。