
本文来自微信公众号: EarlMind ,作者:张翼轸Earl
一家汽车公司预告新品,大家等着看的,通常是一辆更快、更省油、开起来更顺手的新车。
结果幕布拉开,台上放着一套发动机试验台。接口全部开放,零件可以随时更换,甚至允许汽车在行驶中给自己造一个新部件,再装回身上。
懂机械的人会兴奋,普通消费者大概只想问一句:所以,这车到底能不能开?
DeepSeek Harness发布后的两极分化,我觉得大致也是这么来的。
许多人期待的,其实是一款DeepSeek官方调校的代码Agent。过去一段时间,已经有不少第三方产品围绕DeepSeek模型修补结构化输出、优化工具调用、减少缓存消耗,比如我非常喜欢用的Reasonix——甚至在Deepseek的官方网站上,都被作为核心接入Agent的工具来介绍。
既然外部团队都能做,大家自然会期待DeepSeek亲自下场,把模型和Harness之间的配合再往前推一步。
不需要多惊艳。哪怕只是把自家模型的Agent能力稳定提高一些,同时把成本压下来,对于普通用户也已经很有吸引力。
我想,许多人对于DeepSeek自家Harness的预期,是类似对《ZCode全面升级,GLM最佳Harness,让复杂任务自主交付》中的数据那样的:智谱的模型搭配智谱自己的ZCode Agent效果比搭配Claude Code来的更好。

但DeepSeek交出来的,完全是另一个东西。
它没有做一辆调校完成的“官配车型”,而是把试验台本身开放了出来。按照官方的说法,Agent等于Model加Harness;而在DeepSeek Harness里,工具、会话、工作流、子Agent乃至用户界面,都可以被做成插件。Cordis内核只负责插件的加载、卸载和依赖管理,插件甚至可以在Agent运行中更换。
创造模式更进一步:Agent发现自己缺少某项能力,可以现场写一个插件,再挂到当前流程里继续工作。
这当然很有想象力。
今天的大多数Agent,能力边界是产品经理和开发者预先划好的。DeepSeek Harness想做的,则是让Agent在运行中修改自己的能力边界。从这个角度看,它研究的并不是“怎样让DeepSeek写代码更好用”,而是“未来的Agent能否一边工作,一边重组自己”。
这两个问题都重要,却不是一回事。
是的,如果把DeepSeek Harness当成面向普通人的代码产品,它目前很难得到高分。
安装、配置和概念门槛都不低,许多基础体验还要靠社区插件补齐。文件引用、侧边栏、视觉能力、自动化,这些在成熟产品里理应自然存在的功能,在这里反而成了插件生态最先填补的空白。
一个最简单的例子,我们在许多Agent中已经习以为常地用@来标记某个文件,告诉大模型的功能。在Deepseek Harness中却依然需要额外安装第三方插件才能实现。
开放性在此刻既是优点,也像一张尚未完工的清单。
更何况,普通用户并不关心什么时间可组合性、空间可组合性。他只关心模型会不会跑偏,文件会不会改错,任务能否一次做完,以及账单是不是可控。一个系统允许你更换所有零件,不等于它已经比一辆成熟的量产车更好开。
所以,网上最早冒出来的许多“整活”并不奇怪。它们确实证明了这套架构的上限很高,却没有回答普通用户最关心的那个问题:它现在能替我做什么?
不过,如果因此断言DeepSeek Harness没有价值,或许也太早了。
就像编辑器领域的Vim和VS Code,他们的意义,从来不只是默认安装后有多少功能,而在于它们允许开发者按照自己的工作方式持续改造工具。
DeepSeek Harness走得更远:它不仅让人写插件,还试图让Agent为自己写插件。再加上只追加的事件日志,模型的提示词、工具调用、权限变化和子Agent调度都可以被追踪,这套系统对于研究Agent如何行动、如何失控、又如何恢复,显然有它的价值。
只是这份价值,眼下主要属于开发者和研究者。
是的,DeepSeek给产品取名“Harness”,而不是“Code”,其实已经说得很坦白。
它发布的不是一个替你写代码的完整答案,而是一套用来寻找答案的基础设施。问题在于,市场期待的是DeepSeek版本的Claude Code,DeepSeek自己更感兴趣的,却是下一代Agent架构可能长成什么样。
这也很符合DeepSeek一贯给人的感觉。它并不是一家特别愿意为To C体验反复打磨的公司。AGI、模型能力和技术探索排在前面,具体产品更像研究过程里顺手长出来的枝条。
于我而言,DeepSeek Harness现阶段就是一个极客玩具。这不是贬义。极客玩具常常会提前展示未来,只是未来并不会因为被展示出来,就立刻变得好用。
试验台当然可能孕育下一代汽车。
但如果你今天只是想开车上班,大概没必要先学会拆发动机。
如对本稿件有异议或投诉,请联系 tougao@huxiu.com。