为什么"世界级"声明必须靠证据?Yao Meta Skill证据账本与防过度声明守卫完整指南
【免费下载链接】yao-meta-skillYAO = Yielding AI Outcomes. A rigorous engineering, evaluation, governance, and portability system for reusable agent skills.项目地址: https://gitcode.com/gh_mirrors/ya/yao-meta-skill
Yao Meta Skill(YAO = Yielding AI Outcomes)是一套面向可复用 AI Agent 技能的工程、评测、治理与可移植性系统。它的"世界级声明证据账本"逐条记录每项外部与人工证据的接受状态,而"防过度声明守卫"(Claim Guard)会扫描全仓库 201 个声明面,只要账本里还有证据未就位,就禁止任何"已完成/已就绪"的表述出现。这两个机制合起来回答了一个朴素的问题:凭什么说一个项目是世界级的?答案只有一个——证据。
为什么"口头承诺"在工程上不可信
在 AI 工具链领域,"业界领先""全球一流"这类词泛滥成灾。对新手用户来说,这类形容词既无法验证,也无法复现。Yao Meta Skill 的做法是把"世界级"从一个口号变成一个可审计的状态:
- 🚫计划不算完成:写下的待办、本地命令跑出的输出、元数据回退,一律不算世界级证据;
- 🚫计划文档不算证明:证据计划只排任务,不能替代被接受的证据;
- ✅真实来源 + 真实提交:既要源证据通过检查,也要提交包通过 SHA-256 工件校验,两者都满足才算"已接受"。
这套"不伪造证据"(do not fabricate evidence)的原则写进了核心规则 SKILL.md 的治理边界里。
证据账本:四道关卡,一关没过都不放行
打开 reports/world_class_evidence_ledger.md,你会看到一张清晰的账本:当前ready to claim world-class: false,4 项证据全部处于pending状态。
| 证据项 | 类别 | 当前状态 | 卡在哪 |
|---|---|---|---|
provider-holdout | 外部 | 模型执行 10 次、token 已观测 | 缺少真实提交包 |
human-adjudication | 人工 | 0/5 条盲审裁决 | 缺少真实评审员决策 |
native-permission-enforcement | 外部 | 本地安装器强制 4 个目标 | 缺少真实客户端原生强制 |
native-client-telemetry | 外部 | 外部事件 0 条 | 缺少真实客户端遥测 |
每一项证据都配有四个固定部分:目标(objective)、溯源要求(Provenance)、来源操作手册(Source Runbook)、隐私契约(Privacy Contract)。比如"人工裁决"这项,要求评审员身份、盲测 A/B 决策、答案揭晓前的封存——评审员没写下真实选择之前,答案钥匙文件根本不允许打开(见 reports/blind-human-review-2026-06-29/README.md)。
配套的 reports/world_class_evidence_plan.md 则把这些缺口变成可执行任务清单:谁来做、跑什么命令、成功判据是什么、哪些文件是证据工件。计划与账本严格分离——计划通过不等于完成。
防过度声明守卫:给"吹牛"装上自动刹车
证据账本管"进",守卫管"出"。运行python3 scripts/yao.py world-class-claim-guard .后生成的 reports/world_class_claim_guard.md 会告诉你:
- 扫描了201 个声明面(JSON 报告 97 个、元数据 98 个、包/运行时 17 个);
- 当前违规数:0;
- 结论:
claim-guard-pass-evidence-pending——守卫在运行,但账本未就绪,所以一切"完成态"措辞依然被拦截。
守卫的规则表(定义在 scripts/render_world_class_claim_guard.py)覆盖中英文:
| 规则 | 拦截什么 |
|---|---|
ready-to-claim-true | 账本未就绪时ready_to_claim_world_class: true |
json-world-class-ready-true | 机器可读字段提前置true |
completion-phrase | "world-class complete/achieved/certified" 等英文完成态 |
zh-completion-phrase | "世界级已完成/已达成/认证通过" 等中文完成态 |
这意味着:哪怕某位开发者手滑在 README 里写了一句"我们的技能已认证通过",CI 里的守卫也会把它标为违规。诚实不是靠自觉,而是靠流程保证。
证据提交包:隐私与真实性的双重契约
外部证据怎么进仓库而不泄露敏感信息?入口契约定义在 evidence/world_class/README.md,结构校验由 evidence/world_class/intake.schema.json 完成。它的拦截逻辑非常"较真":
- 🔐 凭据、密钥、原始用户内容、原始 provider prompt 一律拒收,即使嵌套在深层字段里也会被拒绝;
- 📦 真实提交必须引用技能目录内的具体文件,且每个工件附带匹配的 SHA-256 摘要;
- 👤 人工裁决包必须包含评审员身份、评审日期、A/B 胜者、置信度和必填理由,缺一项都不算数;
- 📄 模板只是模板:预填工件摘要的草稿仍标记
template_only: true,真实评审存在之前不算证据。
world-class-preflight命令还能在找评审员之前先做"预检":检查本地文件、脱敏环境就绪度和阻塞项,且全程不打印任何秘密。
这套设计对新手意味着什么
如果你自己也在维护 AI 技能或开源项目,这套"证据优先"的思维方式可以直接借鉴:
- 把形容词变成布尔值:
ready_to_claim_world_class只能由账本推导,不接受人工手填; - 计划、进度、声明三者分离:计划报告、账本、公开声明各自独立,互相牵制;
- 隐私契约前置:先定义"什么不能提交",再谈"提交什么";
- 守卫常态化运行:把检查放进 CI,让违规在合并前就被发现。
想亲手跑一遍,可以在克隆仓库后执行:
python3 scripts/yao.py world-class-ledger . python3 scripts/yao.py world-class-claim-guard . python3 scripts/yao.py world-class-preflight .三份报告分别回答:证据到哪了、声明有没有越界、下一步该收集什么。全部只读、不写盘、不联网——这正是 Yao Meta Skill 的治理哲学:让每一句对外承诺,都有据可查。
📌 延伸阅读:evidence/world_class/templates/ 下有四类证据的提交模板;references/governance.md 阐述整体治理方法;reports/skill_os2_coverage.md 展示 Skill OS 2.0 各模块的证据覆盖全景。
【免费下载链接】yao-meta-skillYAO = Yielding AI Outcomes. A rigorous engineering, evaluation, governance, and portability system for reusable agent skills.项目地址: https://gitcode.com/gh_mirrors/ya/yao-meta-skill
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考