宅中地 - 每日更新
宅中地 - 每日更新

贊助商廣告

X

DeepSeek Harness 來了,它不想做下一個Codex

2026年08月13日 首頁 » 熱門科技
DeepSeek Harness 來了,它不想做下一個Codex

就在剛剛,DeepSeek 正式發布了首款 Agent 產品,DeepSeek Harness。

早在 V4 Flash 正式版更新日誌里,除了直接對標 Claude Opus 模型的 benchmark 成績,還有一行說明寫著「正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness 極簡模式(即將發布)作為框架進行測試。」

APPSO 在發布之前拿到了 DeepSeek Harness 的內測資格,管理項目、長任務協作、多 Agent 編排、上下文管理以及聯網搜索和 Skill 等等,這些本地 Agent 工作檯該有的功能,DeepSeek Harness 全部都有。

DeepSeek Harness 來了,它不想做下一個Codex

▲ DeepSeek Harness 自己描述的與 Codex 的區別

但如果只是用「DeepSeek 版 Codex」來形容它又肯定不夠,自定義的 Agent 預設,可重建的會話,以及強大的插件功能,都讓 DeepSeek Harness 變得和傳統的 Codex 類產品不太一樣。

當 DeepSeek 也開始爭奪模型輸出之後的 Agent 執行層,這個姍姍來遲的 Harness 除了可以讓手上本就「物美價廉」的 DeepSeek 模型更好用,更重要的是,它或許會改變我們使用 Agent 的習慣。

先來認識一下 DeepSeek Harness

以下功能和界面等內容均來自內測版,可能與正式版略有出入,以正式發布的版本為主。

第一眼看和市面上大多數的本地 Agent 產品沒什麼兩樣,左側邊欄從上到下依次是「新建會話」、「工作區」,以及不同工作區/文件夾內的多個會話。

DeepSeek Harness 來了,它不想做下一個Codex

對話的設置部分,我們可以切換不同的工作區,不同的模型和思考深度,一共有 Off、High、Max 三檔推理等級,還有允許 DeepSeek Harness 可訪問的權限。

DeepSeek Harness 來了,它不想做下一個Codex
DeepSeek Harness 來了,它不想做下一個Codex

和一般的 Codex 產品只區分日常/辦公、辦公/代碼等工作場景不同,DeepSeek Harness 使用一套「Agent 預設」來應對不同的任務

在 V4 Flash 正式版中提到的極簡模式(minimal),正是 Harness 內置的四種 Agent 預設之一,它適合用於簡單修改、測試最小 Agent,沒有壓縮、搜索、Skill、計劃和子 Agent 這些功能。

DeepSeek Harness 來了,它不想做下一個Codex

▲ 寫作工作檯是我們自己創建一個 Agent 預設

另外三種預設模式分別是適合用來日常寫代碼、修 Bug、分析項目,以及默認選擇的標準模式(standard);處理大批量搜索、並行讀取和多步驟自動處理的代碼模式(code);以及能開發新的 Agent 預設或插件的創造模式(cordis)。

不同的 Agent 預設模式可使用的命令不同,我們也可以直接在輸入框內使用「/」快速選擇不同的指令或 Skills。

DeepSeek Harness 來了,它不想做下一個Codex

標準模式、代碼模式和創造模式,都包含有對話壓縮、目標、計劃等命令,而極簡模式下,只有目標命令。

用創作模式自定義 Agent 預設

對於什麼是 Agent 預設,以及幾款 Agent 預設的具體區別,我們還能在設置頁面看到詳細的情況。

DeepSeek Harness 來了,它不想做下一個Codex

預設即一個會話的 Agent 所運行的插件組裝 —— 它的工具、提示詞與能力。複製一份既有預設改成自己的,或用「創造模式」讓 Agent 幫你創建。

如果說模型等於大腦,決定基礎的推理和理解能力;Skill 等於一份操作手冊,告訴模型遇到某類任務時,具體怎麼做;Tool / 插件 相當於軟體和權限,它決定了模型能否搜索、改文件、運行命令、收發郵件等。

那麼 Agent 預設就是一個崗位+工作環境,身份、長期規則、可用工具、工作方式,都由 Agent 預設決定。

一個 Agent 預設通常由一份配置文檔構成,文檔內把 Agent 的系統提示詞、工具、上下文壓縮和多 Agent 能力完整組合起來。

DeepSeek Harness 來了,它不想做下一個Codex

我們也新建了一個專門用於寫作的 Agent 預設,在這份預設內,不僅可以使用文件進行配置,還能引入文件夾,加入不同的 Skill,來讓自己的 Agent 更加完善。

DeepSeek Harness 來了,它不想做下一個Codex

▲ 自定義寫作工作檯 Agent 預設文件夾內包含的資訊

DeepSeek Harness 內也提供了「用創作模式自定義預設」的方法,就像大多數 Agent 用對話創建 Skills 一樣,我們可以一步步要求 Harness 創建一個自己的 Agent 預設。

在設置頁面,我們還能看到模型的配置,DeepSeek Harness 允許我們接入不同的第三方大模型,默認提供方包括 Kimi、OpenAI、Anthropic、Google 等將近 40 個大模型廠商。

DeepSeek Harness 來了,它不想做下一個Codex

一切都是插件化運行

最後一項設置是 DeepSeek Harness 這次的重頭戲——插件,DeepSeek Harness 在內測產品中介紹里寫著「Everything is a plugin」,一切皆插件。

DeepSeek Harness 來了,它不想做下一個Codex

這個插件有多離譜,在內測的項目倉庫里,參與內測的用戶短短幾天的時間就已經開發了約 300 個插件。

DeepSeek Harness 來了,它不想做下一個Codex

有的插件能把 DeepSeek Harness 整個的工作界面修改,有的可以像 Codex 一樣接入自定義桌面寵物,還有針對對話界面的優化,以及為 DeepSeek Harness 帶來「跨會話長期記憶 + 後台自我進化」能力的純插件實現。

雖然最底層的記憶依然是本地文件,但這套插件並沒有把「長期記憶」做成傳統的向量資料庫 + RAG,而是通過本地文件持久化 + 分層上下文注入 + LLM 自我整理,形成了一套完整系統。

DeepSeek Harness 來了,它不想做下一個Codex

插件的能力還在於能實現模型的自我進化,定期讓 LLM 回頭審視自己的完整工作上下文,把臨時經驗壓縮成長久知識。

DeepSeek Harness 來了,它不想做下一個Codex

▲使用該記憶插件的 DeepSeek Harness 界面

但無論是記憶插件,還是皮膚插件,這些都只是插件能力的冰山一角。

在 DeepSeek Harness 的開發文檔里,從架構層面來說,插件幾乎就是 DeepSeek Harness 的主打,模型、工具、策略、儲存、上下文和界面都能通過插件進行替換或組合。

通常我們理解的插件是給當前的產品增加一些小功能,就像 VS Code 里有著豐富的插件系統,或者是 Chrome 瀏覽器,我們能安裝不同的插件,增加瀏覽器對應的能力。

DeepSeek Harness 來了,它不想做下一個Codex

Codex 應用內也有大量的插件,像是電腦使用、Chrome、Notion 等等對應不同的工具和服務。

但 DeepSeek Harness 這次給出的插件,是在 Agent 的大腦、工具箱、規則和界面里加能力,它更深入、更自由。

如果你嫌 DeepSeek 官方界面太簡潔,不妨加點廣告。

DeepSeek Harness 來了,它不想做下一個Codex

▲ 內測用戶自己開發的 DSH 插件,能夠直接修改頁面 UI

舉個例子,一個 Agent 的「標題生成插件」,通常是在對話里增加一個按鈕或命令,點擊後調用 AI 根據已有命令處理。

一個 DSH 的「寫作插件」,則可能同時做到:給 Agent 增加 /headline 等能力;註冊一個模型可以自主調用的標題工具;換掉系統提示詞和寫作規則;接入我們的各類 Skills; 增加網頁檢索或外部 MCP;保存文章素材和長期偏好;在 DeepSeek 的交互頁面中增加寫作面板;限制這個 Agent 可以使用哪些 Shell、文件或網路工具……等等。

市面上插件功能同樣強大的產品可能是 Pi Agent,它也可以通過 Extension 改寫工具、模型請求、會話行為和終端界面。

DeepSeek Harness 來了,它不想做下一個Codex

▲ Pi 的介紹寫著「有很多 Agent,但這個才是你的」

Pi 讓一個 Coding Agent 可以任意擴展;DSH 則試圖讓整個 Agent 產品都由插件重新組合。

DeepSeek Harness 來了,它不想做下一個Codex

用起來怎麼樣

很難想像吧,以快著稱的 DeepSeek,有一天運行一項編程任務的時間也會來到半個多小時。

DeepSeek Harness 來了,它不想做下一個Codex

為了觀察執行層能給同一個模型帶來多大變化,我們讓 DeepSeek-V4-Flash 分別在 DeepSeek Harness、Reasonix 和 Codex 中完成同一個 Three.js 滑沙遊戲。

先看使用 V4 Flash 在 DeepSeek Harness 中的表現,基本上沒有太多可以挑剔的 Bug,玩家一開始就在滑行,完全遵守核心玩法,穿過下坡途中的每個門,最終抵達沙漠綠洲。

DeepSeek Harness 來了,它不想做下一個Codex

而使用剛剛上新的 V4 Pro,用時更長,表現反而更沒那麼好。

DeepSeek Harness 來了,它不想做下一個Codex

雖然界面似乎有更加精美了一點,太陽光沙漠都更自然,但是金字塔等元素又很抽象。

DeepSeek Harness 來了,它不想做下一個Codex

▲ 使用 DeepSeek V4 Pro 正式版,在 DeepSeek Harness 內生成

Reasonix,據說是最適合 DeepSeek 的第三方 Agent ,我們讓它處理了同一個任務,看看 V4 Flash 正式版模型,在不同的 Harness 應用中,表現會有什麼不同。

DeepSeek Harness 來了,它不想做下一個Codex

同樣是最高等級的推理,差別真的很大。

首先是整體畫面的美感就完全不如 DeepSeek Harness 所交付的「金黃、快速、陽光明媚、清晰明朗」,其次雖然遊戲同樣能玩,但是太過於簡陋,渲染的金字塔、人物、天空都很粗糙,不像是一款 3D 遊戲。

DeepSeek Harness 來了,它不想做下一個Codex

而如果是 Codex+DeepSeek V4 Flash 的組合呢,一開始我們在本地新建了一個文件夾,Codex 的處理方式很聰明,他說他自己先掃描了一遍本地文件夾,發現了另一個項目中存在一個 3D 庫的複製文件。

接著他又找到了我使用 DeepSeek Harness 創建的 pyramid-speed-run 項目,他說他要先看看那個是怎麼處理 3D 庫文件的,但是他不會直接複製,然後把那個項目作為一個原型參考,開始構建自己的項目。

DeepSeek Harness 來了,它不想做下一個Codex

一個是允許他繼續參考做出來的網頁,一個是我們新開了一個對話,讓 Codex 完全依靠自己的工具處理的網頁。

DeepSeek Harness 來了,它不想做下一個Codex

▲ 使用 V4 Flash 正式版的 Codex,乾淨工作區組

DeepSeek Harness 來了,它不想做下一個Codex

▲ 使用 V4 Flash 正式版的 Codex,受污染上下文組

兩個版本似乎都比用 Reasonix 要更好,和 DeepSeek Harness 版本相比,似乎還是 Harness 版本給人沉浸感更強。

「受污染」版把色彩調好的同時,但是金字塔完全不像是金字塔。而從 0 開始做的版本確實有 Codex 的感覺,整體畫面更明亮,也更簡單。

就像 V4 Flash 使用極簡模式的 DeepSeek Harness 進行評測能得到更好結果。

這個單次案例雖然無法證明 Harness 在所有任務上更強,但至少說明:當模型完全相同時,Harness 提供的工具、提示詞、上下文組織和執行策略,已經足以顯著改變最終產物。

它不是 DeepSeek 版 Codex

查看 DeepSeek Harness 倉庫中大量的 Markdown 說明文檔,以及使用指南等內容,可以很確定地說,DSH 不是「DeepSeek 版 Codex」,它更接近一套可重組、可回放的 Agent 運行時。

DeepSeek Harness 真正特別的地方,是把「插件生命周期、每個 Agent 的能力組合、工具執行、會話日誌、Web UI」接進了同一套核心。

從底層的技術配置到如何處理用戶交互、AI 交互,DeepSeek Harness 都有自己獨特的一套流程。

DeepSeek Harness 來了,它不想做下一個Codex

▲ 圖片由 AI 生成

DeepSeek Harness 最重要的插件功能,根據其文檔介紹,它並不只是一個 API 接口,每個工具、模型適配器、策略、提示詞、儲存、UI 區域都可以是插件。

DeepSeek Harness 來了,它不想做下一個Codex

就像我們看到,已經有內測用戶能通過插件,修改 DeepSeek Harness 的主界面。

其次是 Profile 和 Preset 構成的兩級組合系統,Profile 決定整個 DSH 進程怎麼運行,例如 Web、Headless、安裝哪些 Bundle,它本質上是有順序的 cordis.patch.yml 配置層。

Agent Preset(Agent 預設)決定某個會話里的 Agent 能看到哪些工具、提示詞、Skill、子 Agent 和工作流。Preset 的作用域按 agent → preset → global 解析。

DeepSeek Harness 來了,它不想做下一個Codex

根據 Preset 作用域機制,意味著同一個進程中,可以同時運行寫作 Agent、編碼 Agent、研究 Agent,而且各自看到不同的工具和指令,不必啟動四套服務。

另一個有價值的技術點是「模型可見 ⇔ 已記錄」。

普通聊天工具往往只保存最終消息,DSH 保存的是完整事件流: turn/start、step/start 用戶消息、實際請求使用的模型、系統提示詞、工具定義、原始流式等等內容。

同時甚至上下文壓縮也不會刪除原始歷史,只是用 replacement 事件改變模型此後看到的「表面」。

DeepSeek Harness 來了,它不想做下一個Codex

▲DSH-better-sidebar 插件,將 DeepSeek Harness 界面修改為多個側邊欄的 UI

還有採用「先記錄意圖,再執行副作用」的 Agent Loop,以及所有工具共用一條執行核心。即模型可以寫一段 TypeScript,把多個工具調用編排成程序,但中間數據留在運行環境裡,只有最終結果進入模型上下文。

最後一項特別設計就是前端,即我們使用 DeepSeek Harness 的界面,DSH 並不是一個傳統的「固定前端頁面 + 後端插件」,界面本身也是第二棵插件樹。

DeepSeek Harness 來了,它不想做下一個Codex

▲圖片由 AI 生成

應用啟動後,界面掛載機制會加載一組 UI 插件。頁面先聲明側邊欄、對話區、輸入區和設置區等標準掛載位,各插件再把自己的組件註冊進去。

MCP、Skill、網頁搜索、終端、子 Agent、多模型、Plan Mode、Workflow,這些單獨看都已經是 Agent 產品的常見能力。

DeepSeek Harness 的不同在於它把模型、工具、會話、插件和界面,都接入統一的底層機制。

DeepSeek Harness 來了,它不想做下一個Codex

而這帶來的最大改變,大概是以前我們是使用一個通用 AI Agent,每個人都在用一樣的 Codex 去處理辦公、編程、寫作等任務;但 DeepSeek Harness 給我們的是自己探索的空間。

總的來說,Codex 嘗試交付一個拿來即用的 Agent。DeepSeek Harness 更像一套組裝 Agent 的運行時:它把更多結構暴露出來,讓開發者決定 Agent 應該是誰、使用什麼工具,以及如何工作。

既然 Codex 可以切換不同的模型,模型只是 Agent 的一個部件,那 Agent 本身也應該能持續配置、替換和重組

DeepSeek 過去最受關注的是模型本身。現在到了 DeepSeek Harness,它開始處理模型之外的問題:如何組織工具和上下文、保存執行過程,以及在同一套系統里配置不同的 Agent。

以前我們挑 Agent,挑的是哪家公司做出了最好用的那個產品。

DeepSeek Harness 給出的另一種可能是,Agent 和模型同樣是基礎設施。開發者和用戶,可以使用 DeepSeek Harness 創造出無數個 Codex,而真正屬於我們的 Agent,也可以由自己組裝出來。

宅中地 - Facebook 分享 宅中地 - Twitter 分享 宅中地 - Whatsapp 分享 宅中地 - Line 分享
相關內容
Copyright ©2026 | 服務條款 | DMCA | 聯絡我們
宅中地 - 每日更新