
它火了,但没人看懂
一个叫 DeepSeek Harness 的开源项目(代码公开、谁都能拿去用的项目),三个多小时攒下两万七千颗星(GitHub 上的标星,相当于程序员的收藏夹,是项目热度的通用尺子),冲上国外程序员社区 Hacker News 第一名——可评论区的高赞评论没夸它,却在问:这到底是什么?
它 8 月 13 日晚 7 点 56 分在 GitHub(程序员存放代码的网站)公开,到当晚 11 点 15 分是两万七千颗星,再过四十分钟就越过了三万。
我把官方文档、源码、讨论区翻了一遍,这篇就用不写代码的人也能听懂的话,讲清楚它哪里反常识、哪里被高估。
先把词讲清:Harness 是个七百岁的词
Harness(外壳)不是新造的词。七百多年前,它指盔甲和战马的装具;到三百多年前的 1690 年,又多了层动词义:驾驭一种力量去做功。工程师挑这个词,不是随手挑的——本来有两个更常见的选项。
framework(框架)是给代码住的房子,住客是你写的代码;wrapper(封装)是贴在接口上的一层膜。这两个词都装不下它:模型是「一股会自己动的力量」,跟你写的代码是两回事。给这股力量套上装备、让它去干活,才配叫 Harness。
于是有了官网那个公式:Agent = Model + Harness。Agent(智能体)就是会自己动手干活的 AI:聊天框里的 AI 只回答,它接了任务会自己一步步干完。打个比方,模型是发动机,外壳是那辆车。没有车,发动机再好也哪儿都去不了;没有发动机,车是废铁。
顺便说一句,这个公式不是 DeepSeek 发明的。能查到的最早公开用例在 2026 年 2 月,出自技术写手 Simon Willison;随后 Claude Code、OpenAI 那边的人也在用。据媒体报道,DeepSeek 今年 5 月的招聘帖里已经在用,这次写进官网,变成官方口号。它做的是「官方化」,不是「发明」。

它到底做了什么:全身都是能换的零件
这辆车最特别的地方,是全身都是能换的零件——官方口号叫「一切皆插件」,plugin 就是能拆能装的零件。
把它想成一台组装电脑:机箱只负责提供插槽和供电,CPU、显卡、内存随便换,换件不用换机箱。DeepSeek 这层壳分三层:最底下是内核,只管零件的装卸和谁依赖谁,自己什么活都不干;中间是能力层,模型、工具、会话(就是对话记录)、沙箱(给 AI 圈出来的隔离场地,它只能在里面干活)、界面,全是插件;最上面是配置层,不改代码,改一行配置就能换零件。
官方文档原话:There is no privileged core to patch。翻成人话:没有一个享有特权的核心需要你去打补丁——想改功能,旁边挂个新零件就行。连「AI 怎么一步步干活」这个核心循环(agent-loop),都只是官方约 450 行配置文件里的一行。
四种模式,简单带过:标准模式是全家桶,默认就开它;PTC 模式(英文叫 Code mode,代码模式)让 AI 写一小段程序,把多步工具调用压成一次往返。至于 PTC 这三个字母代表什么,官方从头到尾没展开过。极简模式只留两个工具,官方明说是给模型跑基准测试用的;创造模式是让 AI 拆开这台机器,自己组装新模式。同一台车,可以换不同开法——换模式不用换模型。 彩蛋:harness 在评测圈还有旧义「围着模型搭考试装置」,而极简模式的用途恰恰是给模型出考卷——同一个产品里,工位和考场并存。

反常识一:卖发动机的,把整车图纸开源了
DeepSeek 是靠卖模型 API 赚钱的公司,卖发动机的,通常想让你只能用它的发动机。这次它把壳用 MIT 许可全开源,官方文档《配置模型》里逐字写明:可以加 Anthropic、OpenAI 的模型,任意「长得像 OpenAI 接口」的自建服务,甚至 AWS、微软的云。多模型插件原话:「换提供方只是改配置,不是改代码。」
市面 11 个主流 AI 编程工具摆在一起核过:Claude Code 闭源、只认自家 Claude;Gemini CLI 开源,但官方文档只列自家模型;Cline、OpenCode 开源又能接别家,可它们不是模型公司。
真正能和它坐到同一排的,只有一个:OpenAI 的 Codex CLI。那也是模型公司自己出的开源工具,官方文档同样写了怎么接别家的模型。两家的差别在两个细节:Codex CLI 用 Apache 2.0 许可,DeepSeek 用更宽松的 MIT;而且 DeepSeek 把「换提供方只是改配置」直接当卖点写进了官方文档。
所以更准确的说法不是「DeepSeek 独一份」,而是:到 2026 年,已经有两家模型公司把自家的壳开源、并且允许你换掉里面的模型。一家这么干可以叫例外,两家都这么干,说明这层面上的竞争规矩变了。
它也往别人的壳里钻:给 OpenAI Codex 做了一键配置。
官方没解释过动机,下面两条是我的推断。
(我的推断一)壳层入口卡位。用户每天打交道的是壳,壳被 Claude Code 这类绑自家模型的工具圈走,DeepSeek 就永远是别人车里的发动机。
(我的推断二)评测话语权。官方更新日志写明,V4-Flash 的跑分就是拿 Harness 的极简模式当框架测的。评测载体开源成谁都能复现的工具,模型在标准壳下表现如何,成了行业可复核的事实。
反常识二:地基出自一个 QQ 聊天机器人框架
这套壳的骨架基于插件内核 Cordis,作者史益凡(Shigma)。他 2019 年先做 Koishi——给 QQ、Discord 做聊天机器人的框架,社区攒了 4000 多个插件;2022 年把内核抽出来,成了 Cordis。
作者现在 GitHub 的公司字段写着 @deepseek-ai,设计论文署名是北大加 DeepSeek 两家机构——这层关系有意思。我的推断是:所谓押注第三方内核,押的是自己人。
但风险是硬的。Cordis 一千颗星出头,宿主仓库(项目在 GitHub 上的家)三万——差三十倍;550 次提交(一次代码改动的记录)里 537 次是一个人写的,占 97.6%;版本也没毕业,v4 至今只有 rc(候选版)没有稳定版。
对冲动作最能说明问题:它没走 npm(程序员下载软件零件的公共仓库)依赖,而是把 Cordis 源码整体复制进自家仓库,改名、锁死版本,维护了 18 条本地补丁,其中多条是真 bug 的修复。我的判断:自己人写的、还没毕业的项目,DeepSeek 把源码攥在自己手里对冲了风险——留了一手,也说明没到放手的时候。
黑匣子:它干过的每件事,都有据可查
AI 接了个大活,可能连续干几小时——干完你得知道它到底干了什么。所以车里装了个黑匣子:模型看到的每句话、心里的草稿(思维链)、动过的每个工具、改过的每个文件,全写进一份会话日志。
必须说清一件事:这个黑匣子不是行车记录仪那种循环覆盖——存满了就把旧的盖掉。它是只追加、不覆盖:从第一秒到最后一秒,全部记着,不改不删。
这份日志不用等出事才有用。它有专门的视图(Trajectory):翻每一步干了什么,断了能接着干;走错路了,可以从错之前的节点分叉一条新路线重跑,旧记录仍留在日志里。
AI 把活干砸了,你查不出为什么。它改了什么、依据什么、中间哪一步跑偏,全是黑箱。有了黑匣子,岔子能查、责任能说清——这是敢把正经事交给它的前提。

祛魅:「一切皆插件」要分两层听
这次最响的口号是「一切皆插件」。这句话要拆成两层听。
架构层真兑现了:官方仓库两百多个包,几乎全是插件。有个第三方项目只靠一份配置补丁,就把官方三行——系统提示词(官方给 AI 定身份和规矩的那段话)、模型、主循环——全换成自己的实现,没动官方一行源码,发布两小时内拿了 93 星,代码量 3.8 万行。九个能力维度里七个已有多个官方实现可换。
这套设计有多反常识?有现成对照:设计论文调研了 VSCode(程序员最常用的代码编辑器)装机量前 100 的扩展插件,87 个卸载时要把整个软件重启,只有 7 个声明了「我需要依赖谁」。现在的软件大多装上容易、拆下要命;这层壳正好相反:拆了能全还原,零件互相认识。
生态层,还是第 0 天。挂「dsh-plugin」标签的插件仓库,截至 8 月 13 日午夜前已有 358 个——三个多小时里从不到 300 涨上来,可抽样看,中位数只有 1 颗星,大半是当天抢注的标签;官方文档推荐的示例插件,点开是 404;还有社区插件引用的包,在 npm 上根本不存在。
所以我的判断是,想换就换的红利,架构给你了,但要等生态长出来才吃得到。接口都留好了,货架上暂时是空的——官方没吹牛,你也别高估。
这个判断,官方自己也是认的:当前版本是 v0.1 开发者预览版,README(项目自带的说明书)用大写字母写着「一定会有不兼容的改动」,会话格式不承诺兼容;写明暂不接受外部代码,团队很小。这两件事不矛盾:MIT 管的是你使用、修改、商用这份代码的自由;暂不收外部代码,只是不开放把代码合进官方仓库的通道。连给 AI 看的开发文档,都还留着「首次正式发版前删掉本节,目前没有外部使用者」——几乎可以断定是内部文档原样搬出来的。当天,Windows 装不上、中文路径报错、沙箱里模型能给自己批最高权限的漏洞,都有人报了。
星星是注意力,bug 报告是使用量。三万多颗星说明大家在围观,当天两百多条讨论说明有人真在动手——它现在是台刚通电的车,离跑顺还早。
那跟你有什么关系
说实话:现阶段,普通人用不上它。官方定位就是「编码 Agent」——一个会写代码的 AI 员工,没有任何面向非程序员的场景。要跑它,得装 Node.js(跑程序的运行环境)、开终端(打开那个敲命令的黑窗口)、填付费的 API key(给 AI 账户充值的钥匙)。
好消息是外壳本身不要钱,图纸(源代码)也公开,MIT 许可,拿去改、拿去商用都行;但油钱得自己出——按用量计费。官方便宜档模型一百万字符只要几毛钱,听着不多,可 AI 自己干活时一轮接一轮,量上得很快。官方已公告北京时间 8 月 17 日 0 点起调整计费。
很多人会问:它会让我平时用的 DeepSeek 变好吗?直接关系没有——它不是模型升级,不会让你在 App 里聊天变聪明。但间接关系有:开发者拿它把 DeepSeek 接进更多工具,你以后在别的产品里碰到 DeepSeek 的机会就变多。
三类人各说一句。完全外行的:什么也别装,想用 AI 继续用 DeepSeek 的 App 就行。会点技术的:装个 Node.js,在测试目录里跑 npx @deepseek-ai/dsh web 就能启动,保持默认权限——写工作目录以外的东西会先问你;但它读文件、上网、看进程不靠这道沙箱拦着,所以重要项目先放测试目录,别切 danger-full-access。开发者:去看无头模式和插件生态,记住插件是可执行代码,装之前自己掂量。
说到隐私:会话记录、设置和密钥默认存在本机,遥测默认关;但你交给模型处理的内容,会发给你配置的那家模型服务。
最后一句,写给所有人:任何「帮你装、帮你配 key」的一键教程,都别信——API key 就是你的钱包密码,别贴给陌生人。
收尾
模型的竞争,已经打到壳上了。以前 AI 公司比谁家发动机强,现在比谁家整车好开、好改、好查。方向值得盯,车别急着上——现在是看它怎么长的时候,不是上车的时候。
本文事实来源
- DeepSeek:《DeepSeek Harness 官网产品页》(Agent = Model + Harness 公式、四种模式、极简模式与评测用途、会话日志)
- DeepSeek:《deepseek-harness 开源仓库 README 与架构文档》(GitHub;含「一定会有不兼容改动」大写警告、MIT 许可、开发文档中的内部痕迹)
- DeepSeek:开发者文档《配置模型》(可接 Anthropic、OpenAI、自定义兼容端点及云服务)
- DeepSeek:《deepseek-harness 仓库架构文档》(docs/architecture.md)
- OpenAI:《Codex CLI 官方配置文档(自定义模型提供方)》
- Cordis 团队:《A Programming Paradigm for Spatiotemporal Composability》设计论文(VSCode 扩展调研、Koishi 插件数据)
- Hacker News / GitHub Discussions:《DeepSeek Harness 发布讨论帖》(发布当晚登顶首页第一、当日问题记录)