在昨天正式发布 DeepSeek V4 Pro 正式版之后封单真假判断。
预告了很久的,DeepSeek 家自己的 Agent 产品终于也发出来了。
名字叫,DeepSeek Harness。
理念也很清晰,一切皆插件。

可能是有史以来最快的速度,截止到我写完文,它在 Github 上到了 3 万 7 的 Star。

说实话,我在体验完,又完整的扒了开发者文档,用了一些插件之后,我觉得这确实是一个很特别的产品。
这也必然是个二极管产品,喜欢的人会觉得,这就是未来,不喜欢的人会觉得,这玩意太糙了毫无用户体验谁用的明白啊。
所以,我也想用这篇文章,来试图聊聊几个问题,我理解中的 DeepSeek Harness 是什么?为什么不用 DeepSeek Code 要用 DeepSeek Harness 这个很工程的名字?以及这玩意到底应该怎么用。
先来聊聊,DeepSeek Harness 到底该如何理解。
DeepSeek 在官网上放了一条很重要的公式。
Agent = Model + Harness。

这个公式,是 LangChain 之前在聊 Agent Harness 的时候提出来的,一个好的 Agent,必然是由 Harness 和模型一起构成的,对 Harness 不了解的,可以去看看我之前写的一篇科普文:一文带你看懂,火爆全网的 Harness Engineering 到底是个啥。

你用的 Claude Code、Codex、Workbuddy 这些,本质都是 Harness,要跟模型比如 Claude Fable 5、GPT 5.6-Sol 这些搭配起来用才行,要不然就是个纯空壳。
而一个 Harness 的构成,其实还是蛮复杂的,东西特别多。
工具、Skills 系统、会话、沙箱、存储、Agent 循环、调度、子 Agent、工作流等等等等。
在过去,这些所有的东西,都是被封装在一个以软件为名的壳里,比如 Codex。

我们上面所说的一切,几乎都是厂商自己做好的,我们更多的是在用对方持续不断提供给我们的软件服务,也就是一个产品,而那些东西,全都被藏在了后方,普通用户是看不到的,也不需要知道。
普通用户真正要做自定义管理的,其实就是 Skill、MCP 之类的,其他的所有东西,全部都是 Codex 封装好的,你改不了,没事也不会去改。
而在 DeepSeek Harness 中,所有所有所有的这些东西,全部都被包装成了插件,也就是说,你全部都可以自定义。
就很像我们以前玩过的所谓的模块化手机,所有的硬件部分都可以我们随便改。
DeepSeek Harness 也类似,真正的核心只有一个东西,叫 Cordis 的内核,这个内核的作者加入了 DeepSeek,然后这一次,他们甚至发了一篇 88 页的论文。

这个内核干的事情极其克制,只负责插件的加载、卸载和依赖管理,其他的什么都不管。
最牛逼的是,可以在 Agent 运行的过程中,随时更换插件,还能保证 Agent 运行状态不崩。
核心是两个特性:
Temporal composability,时间可组合性,也就是一个插件卸载之后,它之前产生的副作用能不能完整撤销。
Spatial composability,空间可组合性,一个插件如果依赖其他插件,当其他插件出现、消失、改变时,它能不能动态地重新处理自己的依赖
所以你看这两个特性你就懂了。
整个 Cordis 的内核本身,是为了让 Agent 在运行过程中不断的给自己开发、安装卸载插件,不断的插拔自己给自己添加和删除能力,从而形成某种意义的自进化。
这就是 DeepSeek Harness 的底层机制。
所以与其说它是一个 Agent 产品,不如说这是一个为了展示 Cordis 内核给大家预设了 100 多个一方插件的科研成果。
这也就是 DeepSeek 反复强调的理念:
一切皆插件。

所以,现在你也知道,DeepSeek 为啥叫 Harness,不叫 Code 和 Build 之类的,为啥这次的版本,也叫开发者预览版。

因为人做的不是 Agent 产品,人做的是一个基建,是 Harness 系统。
它需要全世界开发者进来,来一起插拔,帮他做各种各样的插件出来,丰富整个 DeepSeek Harness 的生态,从而形成一个新时代的平台,同时完成 Agent 的自进化。
所以,整个社区,才会吵得不可开交。
一边说这个理念太牛逼了太好了,另一边说这玩意鬼才用,我为什么没事要插拔。
一个新事物诞生必然有他的争议,但是无所谓,我觉得对于大家来说,最好的方式,还是上手用一用。
官方网址在此:
https://www.deepseek.com/harness/

安装命令:
npx @deepseek-ai/dsh web
你要是看不懂,不知道咋运行,那就把这个命令随便扔给任何一个你的本地 Agent 产品,让它帮你装。
装好以后,就会给你弹出一个本地网址。

你直接复制到浏览器打开就行。
第一次运行会让你填上你的 DeepSeek API,你去官网搞一个就行,记得充一点钱。

API 开放平台官网:
https://platform.deepseek.com/
贴好以后,就可以进入到首页了。

一个标准的 WebUI 界面,甚至这个界面本身,也是一个 UI 插件。
所以这个 UI 界面,你也是可以随便改的。
比如群友 @黑哥小黑子(blake,随手就做了皮肤插件。。。

然后模型这块,可以选两个,Flash 和 Pro。

也可以选思考强度。

这里模型需要注意一下,DeepSeek 也正式官宣涨价了。

而且涨的不是一丁点两点,这个涨幅说实话,是有一点离谱的。

V4 Pro 的缓存命中价格,直接涨了 12 倍。
高峰期的输出价格,直接来到了离谱的 27 块钱。
这个价格的性价比配合 DeepSeek V4 Pro 的性能,我是觉得从曾经的价格屠夫一下子少了很多的吸引力,我之前预测就是 2 倍左右,结果高峰期涨价实在有点太狠了,起步都是 3 倍。
给大家对比一下现在其他主流模型的价格。

其实跟 GLM、Qwen 3.8 Max 已经不是特别能拉开差距了。
更别提 GLM-5.3 应该马上也要发了,价格大概率是不变的,能力基本上又是个开源 SOTA,那 DeepSeek V4 Pro 的性价比,单从 API 角度来说,就可能比不过 GLM 了。
而在 DeepSeek Harness 里,其实也并没有把你锁死在 DeepSeek 模型上。
网上配资它支持添加目录里的模型提供方,也支持自定义提供方、Base URL、协议和模型列表。以后你完全可以把别家的模型接进来。


比如,你就完全可以在 DeepSeek Harness 里用 GLM。
然后回到首页,点击"选择工作区",添加一个项目目录,这就是你的 Agent,能操作的项目文件范围。

接下来就是最特别的了,也是普通用户最难理解的,大家搞得最懵逼的,四种模式。

我觉得大家在前面知道了 DeepSeek Harness 的内核 Cordis 之后,千万不要把它当成是 DeepSeek Haness 真正的模式来去理解。
这就是他们给你的几种模板预设,对,就是纯粹的模板,方便你开箱即用的。
然后我简单的说一下四种模式的区别。
1. 标准模式
你如果是第一次使用,或者对底层机制没有那么了解的,相信我,无脑选择标准模式就可以了,标准模式拥有完整的代码 Agent 能力,包括文件读取与编辑、Shell、文件搜索、网页搜索、Skills、计划、目标、后台任务、子 Agent 和工作流等等,这些插件都已经给你预设好了。

2. PTC 模式
PTC 模式拥有标准模式的全部能力。
区别出现在工具呈现方式上。
标准模式里,模型通常发起一次工具调用,拿到结果,再决定下一步。PTC 模式会给模型一套 Code Mode SDK,让模型写一段 TypeScript 程序,在一次 run_code 里组合多个工具操作。
原来可能需要五次模型往返的读取、搜索、筛选、并行调用和结果整理,有机会被压进一次程序执行,这会减少模型与工具之间来回对话的次数,也更适合结构化、多步骤、可并行的操作,同时也更省 Token。
元股证券:ygzq.hk但是这就需要模型具备足够稳定的代码规划能力,调试难度还挺高的,小白先不用碰,就用标准模式就行。
等你遇到大量重复工具往返,或者想测试 DeepSeek 模型的程序化工具调用能力,再开 PTC。
3. 极简模式极简模式只给模型两个核心工具:一个持久 Bash,一个文件编辑器。
它还会把系统提示词固定成一句非常简单的"你是一个有帮助的软件工程助手",去掉上下文压缩和大量额外能力。
这个模式主要用于最小环境下的模型基准测试。
就比如你想比较两个模型裸 Agent 能力时,它非常好用。
但是没事别日常用,你会发现根本没法用。。。
4. 创造模式这个才是 DeepSeek Harness 最特别的地方。
创造模式拥有标准模式的完整能力,还能检查自己正在运行的 Cordis 环境,在内存中试验插件,帮助你创建新的 Agent 和插件。
就是说,它能让 Agent 直接改造自己。
比如,你可以告诉它:
"帮我做一个只允许读代码、不允许改文件,专门负责安全审计的模式。"
也可以告诉它:
"帮我做一个接入公司内部搜索、固定使用某个模型、拥有三种专属 Skills 的研究 Agent。"
甚至你可以先让 Agent 来检查自己身上已有的插件和能力,如果你发现它没有某个插件的话,可以直接创造一个插件,然后直接挂到自己正在运行的流程中。
用一个比喻来说,就是 Agent 发现自己没有扳手,于是现场造了一把扳手,插到自己手上,接着用这把扳手继续干活。
这个是整个 DeepSeek Harness 的最核心的特点,也是 Cordis 内核最棒的体现。
然后 DeepSeek Harness 还有一个对开发者很友好也是很特别的一点。
就是他们把会话设计成一份只追加的事件日志。
模型看到的系统提示词、用户消息、推理内容、工具调用和结果、权限变化、上下文注入、压缩、子 Agent 调度,都会成为日志里的事件。
下一轮模型看到的历史,也是从这份日志重新推导出来的。

这件事还是挺有意义的,价值很大。
很多 Agent 失败以后,你只能看到任务失败或者无限循环,根本不知道它在哪一步开始跑偏的。
Harness 里的轨迹视图可以按来源查看每一次运行,对开发者来说,这意味着可观测、可审计、可复现,非常适合做研究。
目前官方的第一方插件,你都可以在设置页面的插件里面看到,看不懂也不用管,你直接用就行了。
如果你觉得缺什么,你也可以用创造模式自己造。
跟 DeepSeek Harness 一起上线的,还有社区插件入口。

有很多开发者开发的三方插件。
我挑了一下,有些不错的,我觉得可以推荐大家装上,能大大的增强你的使用体验。
1. dsh-at-file
https://github.com/omdsh-dev/dsh-at-file
装完后直接在输入框 @就可以调用文件了,很方便。

2. dsh-genui
https://github.com/omdsh-dev/dsh-genui
允许模型在回复里直接渲染图表、表格、表单、Diff、Mermaid、交互面板之类的,很有用。

3. dsh-automation
https://github.com/titanwings/dsh-automation
给 DeepSeek Harness 补上了自动化的能力,刚需,就是这个交互感觉做的稍微有点问题 = =

4. DSH-better-sidebar
https://github.com/omdsh-dev/DSH-better-sidebar
直接给 DSH 补上了一套类似 VS Code 的工作台,文件管理、代码编辑、真实终端、Git、Diff、内嵌浏览器、后台任务和子代理状态,全都塞进了侧边栏里,能让功能更多,也更好用一点。

5. ModLens
https://github.com/liustack/modlens
给纯文本的 DeepSeek 模型补上视觉能力,配置好视觉通道以后,直接往对话里粘贴图片,模型就可以读图了,刚需。

总之,这个 Hanress 的其他有趣的地方,就交给大家去探索了。
最后,我还是想说。
DeepSeek Harness 是一个非常有趣的系统,插件插拔的概念也很棒,但是从产品角度来说,其实对普通用户还是非常不友好的。
过多的开发者术语、过高的使用门槛、过少的功能、过差的用户体验,每一步其实都是会让普通用户劝退的。
但是 DeepSeek 可能本身就是这么一个更加注重科研和探索的团队吧。
就像他们的 Slogan 所说的。
探索未至之境。
加油封单真假判断,DeepSeek。
实盘配资平台|正规股票杠杆服务门户提示:本文来自互联网,不代表本网站观点。