就在刚刚,DeepSeek 正式发布了首款 Agent 产品,DeepSeek Harness。

早在 V4 Flash 正式版更新日志里,除了直接对标 Claude Opus 模型的 benchmark 成绩,还有一行说明写着「正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness 极简模式(即将发布)作为框架进行测试。」

APPSO 在发布之前拿到了 DeepSeek Harness 的内测资格,管理项目、长任务协作、多 Agent 编排、上下文管理以及联网搜索和 Skill 等等,这些本地 Agent 工作台该有的功能,DeepSeek Harness 全部都有。

DeepSeek Harness 自己描述的与 Codex 的区别

DeepSeek Harness 自己描述的与 Codex 的区别

但如果只是用「DeepSeek 版 Codex」来形容它又肯定不够,自定义的 Agent 预设,可重建的会话,以及强大的插件功能,都让 DeepSeek Harness 变得和传统的 Codex 类产品不太一样。

当 DeepSeek 也开始争夺模型输出之后的 Agent 执行层,这个姗姗来迟的 Harness 除了可以让手上本就「物美价廉」的 DeepSeek 模型更好用,更重要的是,它或许会改变我们使用 Agent 的习惯。

01

先来认识一下 DeepSeek Harness

以下功能和界面等内容均来自内测版,可能与正式版略有出入,以正式发布的版本为主。

第一眼看和市面上大多数的本地 Agent 产品没什么两样,左侧边栏从上到下依次是「新建会话」、「工作区」,以及不同工作区/文件夹内的多个会话。

对话的设置部分,我们可以切换不同的工作区,不同的模型和思考深度,一共有 Off、High、Max 三档推理等级,还有允许 DeepSeek Harness 可访问的权限。

和一般的 Codex 产品只区分日常/办公、办公/代码等工作场景不同,DeepSeek Harness 使用一套「Agent 预设」来应对不同的任务

在 V4 Flash 正式版中提到的极简模式(minimal),正是 Harness 内置的四种 Agent 预设之一,它适合用于简单修改、测试最小 Agent,没有压缩、搜索、Skill、计划和子 Agent 这些功能。

写作工作台是我们自己创建一个 Agent 预设

写作工作台是我们自己创建一个 Agent 预设

另外三种预设模式分别是适合用来日常写代码、修 Bug、分析项目,以及默认选择的标准模式(standard);处理大批量搜索、并行读取和多步骤自动处理的代码模式(code);以及能开发新的 Agent 预设或插件的创造模式(cordis)。

不同的 Agent 预设模式可使用的命令不同,我们也可以直接在输入框内使用「/」快速选择不同的指令或 Skills。

标准模式、代码模式和创造模式,都包含有对话压缩、目标、计划等命令,而极简模式下,只有目标命令。

02

用创作模式自定义 Agent 预设

对于什么是 Agent 预设,以及几款 Agent 预设的具体区别,我们还能在设置页面看到详细的情况。

预设即一个会话的 Agent 所运行的插件组装 —— 它的工具、提示词与能力。复制一份既有预设改成自己的,或用「创造模式」让 Agent 帮你创建。

如果说模型等于大脑,决定基础的推理和理解能力;Skill 等于一份操作手册,告诉模型遇到某类任务时,具体怎么做;Tool / 插件 相当于软件和权限,它决定了模型能否搜索、改文件、运行命令、收发邮件等。

那么 Agent 预设就是一个岗位+工作环境,身份、长期规则、可用工具、工作方式,都由 Agent 预设决定。

一个 Agent 预设通用由一份配置文档构成,文档内把 Agent 的系统提示词、工具、上下文压缩和多 Agent 能力完整组合起来。

我们也新建了一个专门用于写作的 Agent 预设,在这份预设内,不仅可以使用文件进行配置,还能引入文件夹,加入不同的 Skill,来让自己的 Agent 更加完善。

自定义写作工作台 Agent 预设文件夹内包含的信息

自定义写作工作台 Agent 预设文件夹内包含的信息

DeepSeek Harness 内也提供了「用创作模式自定义预设」的方法,就像大多数 Agent 用对话创建 Skills 一样,我们可以一步步要求 Harness 创建一个自己的 Agent 预设。

在设置页面,我们还能看到模型的配置,DeepSeek Harness 允许我们接入不同的第三方大模型,默认提供方包括 Kimi、OpenAI、Anthropic、Google 等将近 40 个大模型厂商。

03

一切都是插件化运行

最后一项设置是 DeepSeek Harness 这次的重头戏——插件,DeepSeek Harness 在内测产品中介绍里写着「Everything is a plugin」,一切皆插件。

这个插件有多离谱,在内测的项目仓库里,参与内测的用户短短几天的时间就已经开发了约 300 个插件。

有的插件能把 DeepSeek Harness 整个的工作界面修改,有的可以像 Codex 一样接入自定义桌面宠物,还有针对对话界面的优化,以及为 DeepSeek Harness 带来「跨会话长期记忆 + 后台自我进化」能力的纯插件实现。

虽然最底层的记忆依然是本地文件,但这套插件并没有把「长期记忆」做成传统的向量数据库 + RAG,而是通过本地文件持久化 + 分层上下文注入 + LLM 自我整理,形成的一套完整系统。

插件的能力还在于能实现模型的自我进化,定期让 LLM 回头审视自己的完整工作上下文,把临时经验压缩成长久知识。

使用该记忆插件的 DeepSeek Harness 界面

使用该记忆插件的 DeepSeek Harness 界面

但无论是记忆插件,还是皮肤插件,这些都只是插件能力的冰山一角。

在 DeepSeek Harness 的开发文档里,从架构层面来说,插件几乎就是 DeepSeek Harness 的主打,模型、工具、策略、存储、上下文和界面都能通过插件进行替换或组合。

通常我们理解的插件是给当前的产品增加一些小功能,就像 VS Code 里有着丰富的插件系统,或者是 Chrome 浏览器,我们能安装不同的插件,增加浏览器对应的能力。

Codex 应用内也有大量的插件,像是计算机使用、Chrome、Notion 等等对应不同的工具和服务。

但 DeepSeek Harness 这次给出的插件,是在 Agent 的大脑、工具箱、规则和界面里加能力,它更深入、更自由。

如果你嫌 DeepSeek 官方界面太简洁,不妨加点广告。

内测用户自己开发的 DSH 插件,能够直接修改页面 UI

内测用户自己开发的 DSH 插件,能够直接修改页面 UI

举个例子,一个 Agent 的「标题生成插件」,通常是在对话里增加一个按钮或命令,点击后调用 AI 根据已有命令处理。

一个 DSH 的「写作插件」,则可能同时做到:给 Agent 增加 /headline 等能力;注册一个模型可以自主调用的标题工具;换掉系统提示词和写作规则;接入我们的各类 Skills;增加网页检索或外部 MCP;保存文章素材和长期偏好;在 DeepSeek 的交互页面中增加写作面板;限制这个 Agent 可以使用哪些 Shell、文件或网络工具……等等。

市面上插件功能同样强大的产品可能是 Pi Agent,它也可以通过 Extension 改写工具、模型请求、会话行为和终端界面。

Pi 的介绍写着「有很多 Agent,但这个才是你的」

Pi 的介绍写着「有很多 Agent,但这个才是你的」

Pi 让一个 Coding Agent 可以任意扩展;DSH 则试图让整个 Agent 产品都由插件重新组合。

04

用起来怎么样

很难想象吧,以快著称的 DeepSeek,有一天运行一项编程任务的时间也会来到半个多小时。

为了观察执行层能给同一个模型带来多大变化,我们让 DeepSeek-V4-Flash 分别在 DeepSeek Harness、Reasonix 和 Codex 中完成同一个 Three.js 滑沙游戏。

先看使用 V4 Flash 在 DeepSeek Harness 中的表现,基本上没有太多可以挑剔的 Bug,玩家一开始就在滑行,完全遵守核心玩法,穿过下坡途中的每个门,最终抵达沙漠绿洲。

本文转自:凤凰网科技

原文地址: https://tech.ifeng.com/c/8vX3XV7yIdW