DeepSeek 本週開源了名為 Harness智慧體構建框架,並同步釋出了旗艦模型 V4-Pro-0813。與以往聚焦於基礎模型不同,此次 DeepSeek 將重心放在了模型之外的“中間層”——決定智慧體能否真正完成任務的軟體集合。Harness 採用 MIT 許可,允許開發者自由修改模型、工具、儲存等元件,甚至可接入競爭對手的模型,這標誌著 DeepSeek 從“模型攪局者”向“平台提供者”的轉變。

Harness 被 DeepSeek 稱為“開發者預覽版”,其設計理念是“智慧體構建套件”而非成品智慧體。它支援開啟程式碼倉庫、編輯檔案、執行 shell 命令、搜尋網頁、制定可執行計劃,並能將任務分派給其他智慧體。更重要的是,Harness 會記錄工具呼叫、結果和模型互動,開發者可以回溯會話,甚至從之前的某個節點分叉繼續。這種設計解決了智慧體在長任務中“失憶”或“跑偏”的痛點。

值得注意的是,Harness 並不強制使用 DeepSeek 自家的模型——模型本身也是外掛。這意味著開發者可以輕鬆地將其他廠商的模型嵌入 Harness,這在此前以模型效能著稱的 DeepSeek 身上頗為罕見。DeepSeek 還警告稱,未來將會有破壞相容性的變更,但未透露具體時間。

與 Harness 一同釋出的 V4-Pro-0813 在官方基準測試中表現亮眼:在 Terminal Bench 2.1 上得分 87.9,在 Toolathlon-Verified 上得分 74.1,在 DSBench-FullStack 上得分 71.1,在 DSBench-Hard 上得分 67.2。這些成績由 DeepSeek 自行公佈,且部分公共編碼智慧體測試是在 Harness 最小模式下執行的,表明 Harness 已深度融入其模型測試流程。

回顧去年年初,DeepSeek 曾憑藉高性價比的模型引發市場震動,導致晶片股受挫、行業對 AI 投資產生質疑。如今,DeepSeek 再次以開源框架切入智慧體賽道,其 MIT 許可策略可能吸引大量開發者採用,從而在模型層與應用層之間建立起新的生態。對於依賴專有智慧體框架的廠商而言,Harness 的出現可能帶來競爭壓力,同時也為整個 AI 產業鏈提供了更多元化的選擇。