DeepSeek 於今日正式釋出其首款 Agent 產品 DeepSeek Harness,標誌著這家以模型見長的公司開始爭奪模型輸出之後的 Agent 執行層。該產品並非簡單的“DeepSeek 版 Codex”,而是一套可重組、可回放的 Agent 執行時,允許開發者深度定製 Agent 的工具、提示詞、上下文與介面。
早在 V4 Flash 正式版更新日誌中,DeepSeek 就曾提及“正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness 極簡模式(即將釋出)作為框架進行測試”,暗示 Harness 與模型效能的關聯。APPSO 在釋出前獲得內測資格,體驗了其專案管理、長任務協作、多 Agent 編排、上下文管理、聯網搜尋及 Skill 等功能。
DeepSeek Harness 的核心特色在於 Agent 預設 與 外掛化架構。預設即一個會話中 Agent 所執行的外掛組裝,包含工具、提示詞與能力。內建四種預設:極簡模式(minimal) 用於簡單修改與測試;標準模式(standard) 適合日常寫程式碼、修 Bug;程式碼模式(code) 處理大批次搜尋與多步驟自動處理;創造模式(cordis) 用於開發新的預設或外掛。使用者可通過“/”命令快速切換指令或 Skills,並支援自定義預設。
外掛是 Harness 的重頭戲,官方宣稱“Everything is a plugin”。內測期間,使用者已開發約 300 個外掛,涵蓋介面修改、桌面寵物、對話最佳化,甚至實現“跨會話長期記憶 + 後台自我進化”的純外掛方案。該記憶外掛通過本地檔案持久化、分層上下文注入與 LLM 自我整理實現,而非傳統向量資料庫 + RAG。外掛還能實現模型自我進化,定期讓 LLM 審視工作上下文,將臨時經驗壓縮為長久知識。
從架構看,外掛幾乎覆蓋模型、工具、策略、儲存、上下文和介面等所有層面,均可替換或組合。DeepSeek Harness 還支援接入第三方大模型,預設提供方包括 Kimi、OpenAI、Anthropic、Google 等近 40 家 模型廠商。
實測中,APPSO 讓 DeepSeek-V4-Flash 分別在 Harness、Reasonix 和 Codex 中完成同一 Three.js 滑沙遊戲。Harness 版本幾乎無 Bug,玩家全程滑行、穿過門抵達綠洲;而 V4 Pro 用時更長但表現稍遜。Reasonix 版本畫面粗糙,Codex 版本則更明亮簡單。單次案例雖不能證明 Harness 全面更強,但表明當模型相同時,執行層提供的工具、提示詞、上下文組織和執行策略能顯著改變最終產物。
DeepSeek Harness 的獨特之處在於將 外掛生命週期、Agent 能力組合、工具執行、會話日誌、Web UI 接入同一套核心,並採用“模型可見 ⇔ 已記錄”機制,儲存完整事件流而非僅最終訊息。上下文壓縮也不會刪除原始歷史,而是用 replacement 事件改變模型所見。此外,所有工具共用一條執行核心,模型可編寫 TypeScript 編排多個工具呼叫,中間資料留在執行環境,僅最終結果進入模型上下文。
前端介面本身也是第二棵外掛樹,應用啟動後加載 UI 外掛,各外掛註冊到標準掛載位。這種設計讓使用者不再侷限於通用 Agent,而是可以自行組裝屬於自己的 Agent。
DeepSeek 過去最受關注的是模型本身,如今 Harness 開始處理模型之外的問題:如何組織工具和上下文、儲存執行過程,以及在同一套系統中配置不同 Agent。這或許意味著,Agent 和模型同樣將成為基礎設施,開發者和使用者可以利用 Harness 創造出無數個 Codex,而真正屬於自己的 Agent 也可以由自己組裝出來。