
就在剛剛,DeepSeek
正式發布了首款 Agent 產品,DeepSeek Harness
。
早在 V4 Flash 正式版更新日誌里,除了直接對標 Claude Opus 模型的 benchmark 成績,還有一行說明寫著「正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness 極簡模式(即將發布)作為框架進行測試。」
APPSO 在發布之前拿到了 DeepSeek Harness 的內測資格,管理項目、長任務協作、多 Agent 編排、上下文管理以及聯網搜索和 Skill 等等,這些本地 Agent 工作檯該有的功能,DeepSeek Harness 全部都有。

▲ DeepSeek Harness 自己描述的與 Codex 的區別
但如果只是用「DeepSeek 版 Codex」來形容它又肯定不夠,自定義的 Agent 預設,可重建的會話,以及強大的插件功能,都讓 DeepSeek Harness 變得和傳統的 Codex 類產品不太一樣。
當 DeepSeek 也開始爭奪模型輸出之後的 Agent 執行層,這個姍姍來遲的 Harness 除了可以讓手上本就「物美價廉」的 DeepSeek 模型更好用,更重要的是,它或許會改變我們使用 Agent 的習慣。
先來認識一下 DeepSeek Harness
以下功能和界面等內容均來自內測版,可能與正式版略有出入,以正式發布的版本為主。
第一眼看和市面上大多數的本地 Agent 產品沒什麼兩樣,左側邊欄從上到下依次是「新建會話」、「工作區」,以及不同工作區/文件夾內的多個會話。

對話的設置部分,我們可以切換不同的工作區,不同的模型和思考深度,一共有 Off、High、Max 三檔推理等級,還有允許 DeepSeek Harness 可訪問的權限。


和一般的 Codex 產品只區分日常/辦公、辦公/代碼等工作場景不同,DeepSeek Harness 使用一套「Agent 預設」來應對不同的任務。
在 V4 Flash 正式版中提到的極簡模式(minimal),正是 Harness 內置的四種 Agent 預設之一,它適合用於簡單修改、測試最小 Agent,沒有壓縮、搜索、Skill、計劃和子 Agent 這些功能。

▲ 寫作工作檯是我們自己創建一個 Agent 預設
另外三種預設模式分別是適合用來日常寫代碼、修 Bug、分析項目,以及默認選擇的標準模式(standard);處理大批量搜索、並行讀取和多步驟自動處理的代碼模式(code);以及能開發新的 Agent 預設或插件的創造模式(cordis)。
不同的 Agent 預設模式可使用的命令不同,我們也可以直接在輸入框內使用「/」快速選擇不同的指令或 Skills。

標準模式、代碼模式和創造模式,都包含有對話壓縮、目標、計劃等命令,而極簡模式下,只有目標命令。
用創作模式自定義 Agent 預設
對於什麼是 Agent 預設,以及幾款 Agent 預設的具體區別,我們還能在設置頁面看到詳細的情況。

預設即一個會話的 Agent 所運行的插件組裝 —— 它的工具、提示詞與能力。複製一份既有預設改成自己的,或用「創造模式」讓 Agent 幫你創建。
如果說模型等於大腦,決定基礎的推理和理解能力;Skill 等於一份操作手冊,告訴模型遇到某類任務時,具體怎麼做;Tool / 插件 相當於軟體和權限,它決定了模型能否搜索、改文件、運行命令、收發郵件等。
那麼 Agent 預設就是一個崗位+工作環境,身份、長期規則、可用工具、工作方式,都由 Agent 預設決定。
一個 Agent 預設通常由一份配置文檔構成,文檔內把 Agent 的系統提示詞、工具、上下文壓縮和多 Agent 能力完整組合起來。

我們也新建了一個專門用於寫作的 Agent 預設,在這份預設內,不僅可以使用文件進行配置,還能引入文件夾,加入不同的 Skill,來讓自己的 Agent 更加完善。

▲ 自定義寫作工作檯 Agent 預設文件夾內包含的資訊
DeepSeek Harness 內也提供了「用創作模式自定義預設」的方法,就像大多數 Agent 用對話創建 Skills 一樣,我們可以一步步要求 Harness 創建一個自己的 Agent 預設。
在設置頁面,我們還能看到模型的配置,DeepSeek Harness 允許我們接入不同的第三方大模型,默認提供方包括 Kimi、OpenAI、Anthropic、Google 等將近 40 個大模型廠商。

一切都是插件化運行
最後一項設置是 DeepSeek Harness 這次的重頭戲——插件,DeepSeek Harness 在內測產品中介紹里寫著「Everything is a plugin」,一切皆插件
。

這個插件有多離譜,在內測的項目倉庫里,參與內測的用戶短短幾天的時間就已經開發了約 300 個插件。

有的插件能把 DeepSeek Harness 整個的工作界面修改,有的可以像 Codex 一樣接入自定義桌面寵物,還有針對對話界面的優化,以及為 DeepSeek Harness 帶來「跨會話長期記憶 + 後台自我進化」能力的純插件實現。
雖然最底層的記憶依然是本地文件,但這套插件並沒有把「長期記憶」做成傳統的向量資料庫 + RAG,而是通過本地文件持久化 + 分層上下文注入 + LLM 自我整理,形成了一套完整系統。

插件的能力還在於能實現模型的自我進化,定期讓 LLM 回頭審視自己的完整工作上下文,把臨時經驗壓縮成長久知識。

▲使用該記憶插件的 DeepSeek Harness 界面
但無論是記憶插件,還是皮膚插件,這些都只是插件能力的冰山一角。
在 DeepSeek Harness 的開發文檔里,從架構層面來說,插件幾乎就是 DeepSeek Harness 的主打,模型、工具、策略、儲存、上下文和界面都能通過插件進行替換或組合。
通常我們理解的插件是給當前的產品增加一些小功能,就像 VS Code 里有著豐富的插件系統,或者是 Chrome 瀏覽器,我們能安裝不同的插件,增加瀏覽器對應的能力。

Codex 應用內也有大量的插件,像是電腦使用、Chrome、Notion 等等對應不同的工具和服務。
但 DeepSeek Harness 這次給出的插件,是在 Agent 的大腦、工具箱、規則和界面里加能力,它更深入、更自由。
如果你嫌 DeepSeek 官方界面太簡潔,不妨加點廣告。

▲ 內測用戶自己開發的 DSH
插件,能夠直接修改頁面 UI
舉個例子,一個 Agent 的「標題生成插件」,通常是在對話里增加一個按鈕或命令,點擊後調用 AI 根據已有命令處理。
一個 DSH 的「寫作插件」,則可能同時做到:給 Agent 增加 /headline 等能力;註冊一個模型可以自主調用的標題工具;換掉系統提示詞和寫作規則;接入我們的各類 Skills; 增加網頁檢索或外部 MCP
;保存文章素材和長期偏好;在 DeepSeek 的交互頁面中增加寫作面板;限制這個 Agent 可以使用哪些 Shell、文件或網路工具……等等。
市面上插件功能同樣強大的產品可能是 Pi Agent,它也可以通過 Extension 改寫工具、模型請求、會話行為和終端界面。

▲ Pi 的介紹寫著「有很多 Agent,但這個才是你的」
Pi 讓一個 Coding Agent 可以任意擴展;DSH 則試圖讓整個 Agent 產品都由插件重新組合。

用起來怎麼樣
很難想像吧,以快著稱的 DeepSeek,有一天運行一項編程任務的時間也會來到半個多小時。

為了觀察執行層能給同一個模型帶來多大變化,我們讓 DeepSeek-V4-Flash 分別在 DeepSeek Harness、Reasonix 和 Codex 中完成同一個 Three.js 滑沙遊戲。
先看使用 V4 Flash 在 DeepSeek Harness 中的表現,基本上沒有太多可以挑剔的 Bug,玩家一開始就在滑行,完全遵守核心玩法,穿過下坡途中的每個門,最終抵達沙漠綠洲。

而使用剛剛上新的 V4 Pro,用時更長,表現反而更沒那麼好。

雖然界面似乎有更加精美了一點,太陽光沙漠都更自然,但是金字塔等元素又很抽象。

▲ 使用 DeepSeek V4 Pro 正式版,在 DeepSeek Harness 內生成
Reasonix,據說是最適合 DeepSeek 的第三方 Agent ,我們讓它處理了同一個任務,看看 V4 Flash 正式版模型,在不同的 Harness 應用中,表現會有什麼不同。

同樣是最高等級的推理,差別真的很大。
首先是整體畫面的美感就完全不如 DeepSeek Harness 所交付的「金黃、快速、陽光明媚、清晰明朗」,其次雖然遊戲同樣能玩,但是太過於簡陋,渲染的金字塔、人物、天空都很粗糙,不像是一款 3D 遊戲。

而如果是 Codex+DeepSeek V4 Flash 的組合呢,一開始我們在本地新建了一個文件夾,Codex 的處理方式很聰明,他說他自己先掃描了一遍本地文件夾,發現了另一個項目中存在一個 3D 庫的複製文件。
接著他又找到了我使用 DeepSeek Harness 創建的 pyramid-speed-run 項目,他說他要先看看那個是怎麼處理 3D 庫文件的,但是他不會直接複製,然後把那個項目作為一個原型參考,開始構建自己的項目。

一個是允許他繼續參考做出來的網頁,一個是我們新開了一個對話,讓 Codex 完全依靠自己的工具處理的網頁。

▲ 使用 V4 Flash 正式版的 Codex,乾淨工作區組

▲ 使用 V4 Flash 正式版的 Codex,受污染上下文組
兩個版本似乎都比用 Reasonix 要更好,和 DeepSeek Harness 版本相比,似乎還是 Harness 版本給人沉浸感更強。
「受污染」版把色彩調好的同時,但是金字塔完全不像是金字塔。而從 0 開始做的版本確實有 Codex 的感覺,整體畫面更明亮,也更簡單。
就像 V4 Flash 使用極簡模式的 DeepSeek Harness 進行評測能得到更好結果。
這個單次案例雖然無法證明 Harness 在所有任務上更強,但至少說明:當模型完全相同時,Harness 提供的工具、提示詞、上下文組織和執行策略,已經足以顯著改變最終產物。
它不是 DeepSeek 版 Codex
查看 DeepSeek Harness 倉庫中大量的 Markdown 說明文檔,以及使用指南等內容,可以很確定地說,DSH 不是「DeepSeek 版 Codex」,它更接近一套可重組、可回放的 Agent 運行時。
DeepSeek Harness 真正特別的地方,是把「插件生命周期、每個 Agent 的能力組合、工具執行、會話日誌、Web UI」接進了同一套核心。
從底層的技術配置到如何處理用戶交互、AI 交互,DeepSeek Harness 都有自己獨特的一套流程。

▲ 圖片由 AI 生成
DeepSeek Harness 最重要的插件功能,根據其文檔介紹,它並不只是一個 API 接口,每個工具、模型適配器、策略、提示詞、儲存、UI 區域都可以是插件。

就像我們看到,已經有內測用戶能通過插件,修改 DeepSeek Harness 的主界面。
其次是 Profile 和 Preset 構成的兩級組合系統,Profile 決定整個 DSH 進程怎麼運行,例如 Web、Headless、安裝哪些 Bundle,它本質上是有順序的 cordis.patch.yml 配置層。
Agent Preset(Agent 預設)決定某個會話里的 Agent 能看到哪些工具、提示詞、Skill、子 Agent 和工作流。Preset 的作用域按 agent → preset → global 解析。

根據 Preset 作用域機制,意味著同一個進程中,可以同時運行寫作 Agent、編碼 Agent、研究 Agent,而且各自看到不同的工具和指令,不必啟動四套服務。
另一個有價值的技術點是「模型可見 ⇔ 已記錄」。
普通聊天工具往往只保存最終消息,DSH 保存的是完整事件流: turn/start、step/start 用戶消息、實際請求使用的模型、系統提示詞、工具定義、原始流式等等內容。
同時甚至上下文壓縮也不會刪除原始歷史,只是用 replacement 事件改變模型此後看到的「表面」。

▲DSH-better-sidebar 插件,將 DeepSeek Harness 界面修改為多個側邊欄的 UI
還有採用「先記錄意圖,再執行副作用」的 Agent Loop,以及所有工具共用一條執行核心。即模型可以寫一段 TypeScript,把多個工具調用編排成程序,但中間數據留在運行環境裡,只有最終結果進入模型上下文。
最後一項特別設計就是前端,即我們使用 DeepSeek Harness 的界面,DSH 並不是一個傳統的「固定前端頁面 + 後端插件」,界面本身也是第二棵插件樹。

▲圖片由 AI 生成
應用啟動後,界面掛載機制會加載一組 UI 插件。頁面先聲明側邊欄、對話區、輸入區和設置區等標準掛載位,各插件再把自己的組件註冊進去。
MCP、Skill、網頁搜索、終端、子 Agent、多模型、Plan Mode、Workflow,這些單獨看都已經是 Agent 產品的常見能力。
DeepSeek Harness 的不同在於它把模型、工具、會話、插件和界面,都接入統一的底層機制。

而這帶來的最大改變,大概是以前我們是使用一個通用 AI Agent,每個人都在用一樣的 Codex 去處理辦公、編程、寫作等任務;但 DeepSeek Harness 給我們的是自己探索的空間。
總的來說,Codex 嘗試交付一個拿來即用的 Agent。DeepSeek Harness 更像一套組裝 Agent 的運行時:它把更多結構暴露出來,讓開發者決定 Agent 應該是誰、使用什麼工具,以及如何工作。
既然 Codex 可以切換不同的模型,模型只是 Agent 的一個部件,那 Agent 本身也應該能持續配置、替換和重組。
DeepSeek 過去最受關注的是模型本身。現在到了 DeepSeek Harness,它開始處理模型之外的問題:如何組織工具和上下文、保存執行過程,以及在同一套系統里配置不同的 Agent。
以前我們挑 Agent,挑的是哪家公司做出了最好用的那個產品。
DeepSeek Harness 給出的另一種可能是,Agent 和模型同樣是基礎設施。開發者和用戶,可以使用 DeepSeek Harness 創造出無數個 Codex,而真正屬於我們的 Agent,也可以由自己組裝出來。






