Agent Harness

DeepSeek 開源 Agent Harness:一切皆外掛的開發者預覽

2026 年 8 月 13 日,DeepSeek 以 MIT 授權公開 DeepSeek Harness 開發者預覽:Cordis 核心做到一切皆外掛,附錄影重播的會話日誌與四種執行模式,原始碼與外掛生態同步開放。

DeepSeek 開源 Agent Harness:一切皆外掛的開發者預覽 — 文章封面

8 月 13 日,DeepSeek 發表 agent harness 的開發者預覽版「DeepSeek Harness」,原始碼完整公開,採 MIT 授權。官網開頭就把立場講清楚:「Agent = Model + Harness」——模型是 agent 的靈魂,但讓 agent「理解環境、使用工具、在真實世界持續工作」的,是 harness 這一層。消息在 Hacker News 拿下 747 點,是當週最受矚目的開發者工具發布之一。安裝只要一行指令:npx @deepseek-ai/dsh web(需要 Node.js),原始碼則放在 GitHub 的 deepseek-ai/deepseek-harness 倉庫。

一切皆外掛:Cordis 核心

Harness 建構在 Cordis 核心之上,負責外掛的掛載、卸載與依賴管理。模型、工具、技能、會話、沙盒、儲存、迴圈、排程到 UI,全部都是外掛。開發者可以在設定檔中選用、替換或擴充任何能力,不需要改 DeepSeek Harness 本身的原始碼。實務上,「我們的 agent」和「官方 agent」的差異可以整層留在設定檔與外掛目錄裡,讓自己的修改之後還能跟上上游。這種設計讓它比較像一套可組裝的 agent 作業系統,而不是單一的 CLI 產品。

可重放的執行紀錄

第二個關鍵是可追蹤性。模型看到的一切——系統提示、推理內容、工具呼叫與結果、子代理排程、上下文注入——都寫進一份附加式會話日誌。續跑、分岔、搜尋、重播,全部在同一條事件流上完成。對除錯與評測來說,這比事後翻對話紀錄完整得多:失敗的執行可以從任一事件點換一個工具結果重播,行為改變也能沿事件史二分定位,「為什麼模型這樣做」變成可以逐步重放的問題。

四種執行模式

預覽版提供四種模式:Standard 是完整的 coding agent,涵蓋檔案編輯、shell、搜尋、技能、規劃、目標、子代理與工作流程;Code 透過 Code Mode SDK,讓模型把多步操作串成一段 TypeScript 程式一次執行,減少往返次數,也減少模型在多次呼叫之間迷失的機會;Minimal 只保留持久化 bash 與 str_replace_editor,用來在最小環境下評測模型本身,等同一個可重現的模型評測基座;Creator 則提供執行期檢查、外掛的記憶體內測試與預設檔製作。四種模式對應四種使用場景:日常開發、批次自動化、基準測試與外掛開發。

Harness 之戰開打

這次發布的產業訊號很清楚:模型公司開始把 harness 當成正式產品線。過去這一層多半由第三方工具鏈補位,現在 DeepSeek 親自下場,而且一次給到 MIT 授權與外掛生態——社群外掛已經以 dsh-plugin 標籤聚集,Cordis 核心也有對應的論文。官方同時老實說明:預覽版仍在測試,核心外掛與 API 會持續變動,要固定上生產的團隊得預期破壞性更新。方向比版本號重要:模型是靈魂,harness 是身體,過去多數團隊只能接受一個無法檢視的閉源身體;如今鎖定成本變成了可以選擇的事,早期卡位的入手成本從來沒有這麼低過。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

這篇內容對你有幫助嗎?

支持本站繼續整理實用的 AI 文章、教學與開發筆記。

請我喝杯咖啡
分享X電郵