news 2026/9/17 5:42:25

用 Harness 开发 Harness:Claude Code Harness 自引用开发模式的终极奥义

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
用 Harness 开发 Harness:Claude Code Harness 自引用开发模式的终极奥义

用 Harness 开发 Harness:Claude Code Harness 自引用开发模式的终极奥义

【免费下载链接】claude-code-harnessClaude Code Dedicated Development Harness - Achieving High-Quality Development Through an Autonomous Plan→Work→Review Cycle项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-harness

Claude Code Harness是一个让 Claude Code 等 AI 编程助手按「Plan(计划)→ Work(执行)→ Review(评审)→ Release(发布)」纪律循环自主开发的项目。它最特别的地方在于:这个 Harness 本身就是用 Harness 开发的——AI 在计划、实现、评审它自己的同时,还要防止自己「钻规则空子」。本文将带你读懂这种自引用(self-referential)开发模式如何运作,以及它给普通开发者带来的启发。

什么是「自引用开发模式」

所谓自引用开发,简单说就是:用某套开发流程工具来改进这套工具本身

在 CLAUDE.md 中,项目方明确写下了一句话:

本项目是自引用的——它用 Harness 本身来改进 Harness。

这意味着当 AI 执行/harness-work实现一个任务时,它编辑的往往就是 Harness 自己的技能文件、脚本和 Go 引擎代码。规则在约束 AI 的同时,AI 又在修改规则的载体——这就是自引用开发的核心张力。

自引用循环:五大动词技能如何「套娃」

Harness 把开发流程压缩成 5 个核心命令(详见 README.md):

命令作用
/harness-plan把意图变成spec.md+Plans.md契约
/harness-work只实现已批准的任务切片
/harness-review独立于实现者的评审
/harness-sync对比计划与实际实现的漂移
/harness-release只打包已验证的证据发布

当这个循环「套娃」到 Harness 自身时,会出现三层递进的自引用结构:

  1. 契约层:spec.md 是产品契约(规定什么必须一直成立),Plans.md 是任务台账(记录 Phase 1 到 138+ 的计划与证据)。AI 的每次改进都必须先落到这两份文件里。
  2. 执行层:AI 按计划实现,但 CLAUDE.md 特别提醒:「对插件运行/work意味着在编辑它自己的代码」——这是自引用场景下的日常现实。
  3. 评审层:评审必须由独立上下文(甚至跨模型,如 Codex 作为伴生评审)完成,防止「自己改的代码自己说好」。

安全网:如何防止 AI「给自己出题、自己判分」

自引用模式最大的风险是:AI 既是被管束的对象,又是规则的修改者。Harness 用三道防线解决它:

  • 运行时地板(Runtime Floor):账单、网络外发、密钥读取、生产部署、越界删除这 5 类操作一律直接拒绝,且没有任何配置、环境变量或权限模式可以关闭它。自主运行无法「说服」自己绕过地板。
  • 护栏规则 R01–R15:如禁止git push --force、保护分支推送需确认等,可按项目配置调整力度。
  • 宪法保护(自我修改保护):spec.md 明确将规则定义文件、deny 基线、settings 文件列为「不可触碰类」——没有任何 AI 路径可以修改它们,只能人类修改;并设有全局急停开关(~/.harness/HALT),可先于一切模型判断拒绝所有工具调用。

此外还有两条「反作弊」纪律:

  • 测试篡改绝对禁止:CLAUDE.md 将「篡改测试伪造成功」列为绝对禁止项,配套的测试接线审计(agents/test-wiring-auditor.md)会检查测试是否真的连着被测代码。
  • 写出来 ≠ 生效:CI 门禁会验证文档声称的组件确实被接线、二进制确实能从源码重建(scripts/ci/check-consistency.sh)。

证据优先:主张必须被机器验证

自引用开发还有一个独特难题:AI 写的文档可能夸大了 AI 实现的功能。Harness 的解法是 docs/claims-audit.md —— 一张「公开主张审计表」,把每条对外宣称的功能分成「现已证明 / 尚未敢强言 / 需补充证据」三类,README 里出现的每一个功能,都必须先通过某个门禁证明它真实可达

配合只追加不改写的判断台账(docs/judgment-ledger.md),人类的关键决策会被记录、可检索、可在未来的决策卡片中被召回——AI 改自己的规则可以有,但必须有迹可循。

给开发者的三个启发

  1. 流程比模型更可靠:Harness 不指望模型变聪明,而是固定流程和边界,「这样模型换代时它依然能用」。
  2. 自引用的关键是人守宪法:让 AI 参与修改自身流程并不可行,可行做法是把「宪法层」留给人,把「执行层」交给 AI,并用只追加日志留痕。
  3. 证据先于宣传:功能声称必须配机器可验证的证据,「未观察到 ≠ 不存在,但也 ≠ 已支持」。

延伸阅读

  • 产品契约正本:spec.md
  • 任务台账与阶段证据:Plans.md
  • 架构文档:docs/ARCHITECTURE.md
  • Go 原生引擎设计:go/SPEC.md、go/DESIGN.md
  • 主张审计机制:docs/claims-audit.md
  • 判断台账:docs/judgment-ledger.md

如果你想体验这种自引用循环,可以在 Claude Code 中通过插件市场安装claude-code-harness,运行/harness-setup后,从一个/harness-plan开始——让 AI 先出契约,你的工作不是写计划,而是批准或修正它

【免费下载链接】claude-code-harnessClaude Code Dedicated Development Harness - Achieving High-Quality Development Through an Autonomous Plan→Work→Review Cycle项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-harness

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/17 5:42:18

用大模型将聊天记录自动写入CRM:JSON结构化提取全链路实践

我们团队半年前接了一个挺头疼的需求:销售每天在企业微信、电话、面谈里产生大量沟通记录,但 CRM 里的跟进记录永远是滞后的,甚至很多高价值客户信息就烂在聊天记录里没人理。老板说,“你们能不能把聊天记录自动变成 CRM 的客户档…

作者头像 李华
网站建设 2026/9/17 5:41:40

Doris与ClickHouse选型指南:OLAP场景下的SQL兼容性与实时更新对比

1. 这不是选“哪个更好”,而是选“谁更对路”:一张表讲透 Doris 和 ClickHouse 的本质分野最近在给一家做实时BI平台的客户做技术选型,他们卡在 Doris 和 ClickHouse 之间反复横跳——前端报表要秒级响应,数据源每天新增2亿行&…

作者头像 李华
网站建设 2026/9/17 5:41:27

HR从业者学习心理咨询的职场价值 中国心理学会心理咨询师水平评价-心理咨询培训机构

HR从业者学习心理咨询的职场价值 中国心理学会心理咨询师水平评价-心理咨询培训机构 心理健康是全民健康的重要组成部分,心理咨询师则是守护公众心理健康的专业力量。随着中国心理学会心理咨询师水平评价等级考试的全面推行,行业准入门槛更加规范化、专业…

作者头像 李华
网站建设 2026/9/17 5:41:20

MuJoCo机械臂角速度实时监控与可视化方案

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华