返回博客列表

DeepSeek Harness发布24小时,有人已经写了一整本书

2026-08-14T12:00:00+08:00
DeepSeekHarnessAgent橙皮书花叔AI Native

DeepSeek Harness发布24小时,有人已经写了一整本书

先收藏,回头一定用得上。

2026年8月13日,DeepSeek 开源了 Agent 框架 Harness。MIT 协议,发布当天直接放到 GitHub 上,没有闭源核心,没有商业版预留。

24 小时后,一本书出现了。

不是博客文章,不是推特长帖,是一本完整的书——有封面、有目录、有序章、有附录,PDF 13MB,EPUB 5.4MB,HTML 4.9MB。书名叫《DeepSeek Harness:从开机到拆开》,作者署名花叔。

更让人意外的是:这个写了一整本 Agent 框架拆解指南的人,从来没手写过一行代码。

本文提纲

  1. 24小时的赛跑:书比文档先到
  2. 这本书里有什么官方文档没有的
  3. 花叔是谁:不写代码的「手搓经济」代表
  4. 七个最硬核的发现
  5. 「他们本来想这么做,后来没做」
  6. 这件事比书本身更值得关注

24小时的赛跑:书比文档先到

先看数据。DeepSeek Harness 的 GitHub 仓库在发布约 24 小时后:

指标 数值
Stars 66,107
Forks 5,578
创建时间 2026-08-13
语言 TypeScript
协议 MIT

橙皮书仓库在同一天创建:

指标 数值
Stars 52
Forks 3
创建时间 2026-08-14
协议 CC BY-NC-SA 4.0
格式 PDF / EPUB / HTML

花叔在 README 里写了一句话,精确概括了这本书的定位:

官方发布稿的主语从头到尾是「它」——它怎么造的、它是什么架构。而这本书把主语换回「我」:我装上之后第一件事干什么、会不会花我的钱、会不会动我硬盘上别的文件。

这句话本身就是一种方法论。官方文档告诉你产品怎么设计的,橙皮书告诉你产品装到你机器上之后到底发生了什么。两者不冲突,但后者你从官方渠道永远拿不到。

这本书里有什么官方文档没有的

花叔在 README 里列了一份清单,全部是一手实测:

  • 完整系统提示词——每次开口之前被灌进模型脑子里的那一大段话
  • 129行出厂启动清单——dsh --profile web --dump-default-config 导出,一行行看它开机装了什么
  • 三份原始会话日志——标准模式、PTC、创造模式各一份,一条事件都没删
  • AI现场给自己造工具的全程——19步,工具清单从32行变成33行,多出来的那一行是它自己写的
  • PTC实测账单——5次开口编排15次操作,以及那笔反直觉的账:固定开销反而涨9%
  • 35个不随产品安装的扩展包清单——都在npm上,但不在安装闭包里
  • 代码库考古——12,293次提交/约64天、683篇Agent Note、4篇事故复盘

这不是文档翻译,不是发布会转述。每一项都是作者在自己电脑上跑出来的。

花叔是谁:不写代码的「手搓经济」代表

到这里必须介绍一下花叔这个人,因为他的身份本身就是这个故事里最反直觉的部分。

花叔(HuaShu),AI Native Coder,独立开发者。

  • 小猫补光灯的开发者——App Store 付费榜第一
  • 橙皮书系列作者,全平台 50 万+ 读者
  • CCTV《焦点访谈》报道的「手搓经济」代表人物
  • 所有产品全部用 AI 完成,从未手写过一行代码

橙皮书系列已经出版了好几本:Claude Code 从入门到精通、Claude Code 源码解析、Harness Engineering、Agent Skills、OpenClaw:养一只你自己的AI、OpenAI Codex 从入门到精通。DeepSeek Harness 这本是最新的。

一个不写代码的人,给一个用 TypeScript 写的 Agent 框架写了一本拆解指南。这个事实本身就是 AI Native 时代最好的注脚:工具的使用者可以成为工具最深刻的解读者,前提是你愿意把自己当作实验对象。

七个最硬核的发现

从 README 透露的内容来看,这本书里有几个发现特别值得关注。

1. 完整系统提示词

系统提示词是 Agent 框架最核心的部分——它决定了模型每次开口前脑子里被灌了什么。大部分 Agent 框架不会公开完整的系统提示词,因为它包含安全约束、行为规范、工具使用逻辑等敏感信息。

花叔把 Harness 的完整系统提示词原样放了出来。这意味着你可以看到 DeepSeek 在设计这个框架时,是怎么定义 Agent 的行为边界的。

2. 129行启动清单

通过 dsh --profile web --dump-default-config 导出的出厂配置,129行。这不是文档里列出的功能清单,而是框架真正启动时加载的全部配置——每一个开关、每一个默认值、每一个路径。

这种「开机装了什么」的透明度,在 Agent 框架领域极为罕见。Claude Code 至今没有公开过等价的信息。

3. AI给自己造工具(19步,32→33)

这是全书最戏剧性的段落。Harness 在执行任务时,发现自己需要一个不存在的工具,于是花了19步操作,自己写了一个新工具,工具清单从32行变成33行。

这不是预设的演示,是在真实任务中自发发生的。Agent 自己识别能力缺口、自己补上——这是 Agent 从「调用工具」进化到「创造工具」的实证记录。

4. PTC的反直觉账单

PTC(Programmatic Task Control,编程式任务编排)是 Harness 的一个高级功能。花叔实测了5次开口编排15次操作,结果发现:固定开销反而涨了9%。

这和直觉完全相反——编排本来是为了省钱的。花叔把原始账单放了出来,让读者自己判断。这种「卡住的地方才有可信度」的态度,是这本书最大的价值。

5. 35个隐藏扩展包

Harness 在 npm 上有35个扩展包,但它们不在默认安装闭包里。花叔把完整清单列了出来。

「仓库里有」不等于「装上就有」。这个区别对于评估一个框架的真实能力边界非常重要。

6. 代码库考古

指标 数值
提交次数 12,293
开发周期 约64天
Agent Note 683篇
事故复盘 4篇

其中一篇事故复盘的标题特别有意思:「100%覆盖率全绿,编辑器一连上就崩」。这揭示了一个测试的经典陷阱:你的测试全绿不代表你的产品没问题。

7. 四种模式实测

花叔把 Harness 的四种模式(标准模式、PTC、创造模式等)各跑了一遍,每份日志一条事件都没删。原始日志的价值在于:你可以看到 Agent 在每一步到底想了什么、做了什么、卡在了哪里。

「他们本来想这么做,后来没做」

每节末尾有个固定小栏目:《他们本来想这么做,后来没做》

这个栏目的素材取自仓库里被否决的设计方案,回答的是一个简单但重要的问题:为什么这里没有X?

在技术评测中,「没做什么」往往比「做了什么」更能说明设计意图。一个框架选择不做什么,和它选择做什么一样,都是设计决策的产物。花叔从代码仓库里挖出这些被否决的方案,等于给读者提供了一份「反设计文档」。

这件事比书本身更值得关注

这本书的质量当然很高,但更值得关注的是它背后的模式。

第一,AI Native 时代的知识生产速度。 DeepSeek 8月13日开源,花叔8月14日出书。24小时内完成「安装→测试→记录→成书→发布」的全链条。这在传统技术写作中是不可想象的——光是跑通一个框架的第一步就可能卡一天。AI 让知识生产的瓶颈从「执行速度」转移到了「洞察速度」。

第二,不写代码的人可以成为最深刻的解读者。 花叔的优势恰恰在于他不写代码——他不预设任何技术偏见,把框架当作黑盒来测试,记录每一个卡住的瞬间。这种「用户视角」的技术拆解,比开发者自己写的文档更有参考价值,因为文档写的是「设计意图」,而花叔写的是「实际体验」。

第三,橙皮书系列正在成为一种新的知识标准。 花叔已经写了七本橙皮书,覆盖 Claude Code、Codex、Harness 等主流 Agent 工具。这个系列的特点是一致的:一手实测、原始日志、反直觉发现、被否决的方案。它不是教程,是「田野调查报告」。

第四,DeepSeek Harness 本身的开源质量值得这个待遇。 66K stars、5578 forks、MIT 协议、发布当天全量开源——这个量级的项目配上这个量级的拆解,是双向的认可。花叔选 Harness 作为橙皮书的下一本,说明他认为这个框架值得花24小时去拆。

参考文档与链接

试过了Harness?这本书里哪个发现最让你意外?评论区聊聊。觉得有用点个赞让更多人看到。


作者: itech001 来源: 公众号:AI人工智能时代 网站: https://www.theaiera.cn/ 每日分享最前沿的AI新闻资讯和技术研究。

本文首发于 AI人工智能时代,转载请注明出处。

分享给朋友