Caveman Skill:用 /caveman 六个模式削掉 AI 编码助手 65% 的输出 token
【免费下载链接】caveman🪨 why use many token when few token do trick. Viral skill + proxy for coding agents that cuts 65% of tokens by talking like a caveman.项目地址: https://gitcode.com/GitHub_Trending/caveman1/caveman
Caveman Skill 是给 Claude Code、Codex、Gemini CLI 等 AI 编码助手用的 token 压缩技能,让 AI 用极简语言回答,参考基准下平均削减 65% 的输出 token。如果你按 token 计费、又被 AI 的啰嗦回复刷账单,这篇文章给你一条最短上手路径。
先算账:哪些任务开它才划算
Caveman Skill 只压输出 token,不碰输入。官方基准里,长解释、长配置类任务收益最大,单任务最高省 87%,十个典型任务平均省 65%。
但它有一笔固定开销:每轮调用都会把规则注入上下文,约 1–1.5k 输入 token。两个结果:
- 回答本来就很短的任务(一句话问答),固定开销可能比省下的还多
- 按次/按请求计费的场景(如 Copilot 高级请求),回答变短账单也不变
详细边界和实测案例见 docs/HONEST-NUMBERS.md。所以先用下面这条法则定边界:长输出任务开,短问答和按次计费的任务关。
两分钟装好:两条命令的事
安装只有两条路,选一条即可:
# 通用安装,skills 兼容的代理都适用 npx skills add JuliusBrussee/caveman# 或者拉源码,本地安装前先看清它动了什么 git clone https://gitcode.com/GitHub_Trending/caveman1/caveman激活方式取决于你的代理,完整矩阵在 INSTALL.md:
| 代理 | 激活方式 |
|---|---|
| Claude Code、Gemini CLI | 装完自动激活 |
| Codex、Cursor、Cline 等 | 会话里输入/caveman开启 |
模式选型速查表:按场景挑,不用背
六个强度模式(lite / full / ultra / wenyan-lite / wenyan-full / wenyan-ultra),不用背定义,对照场景挑:
英文输出用这组:
| 模式 | 一句话定位 | 适合谁 |
|---|---|---|
| lite | 去填充词,保留完整句子 | 要发给同事看的解释 |
| full | 默认档,去冠词、允许短句碎片 | 日常编码问答 |
| ultra | 砍到只剩事实,连词能省则省 | 只给自己看的极简摘要 |
中文输出用 wenyan 系列 🏮:
| 模式 | 一句话定位 | 适合谁 |
|---|---|---|
| wenyan-lite | 半文半白,保留语法结构 | 习惯白话、想轻压缩 |
| wenyan-full | 完整文言文,省主语、可倒装 | 追求极致中文字符压缩 |
| wenyan-ultra | 极限缩写,古文语感拉满 | 只要结论、不要过程 |
三条短原则定决策路径:
- 默认从 full 起步,不带参数就是 full
- 嫌 full 还长,升 ultra
- 中文输出直接走 wenyan 系列,别在英文档里硬切
切换语法统一:/caveman <模式名>,例如/caveman lite。关掉用/caveman off,或直接说 "stop caveman"。选定模式在会话内持久生效,所有后续回答保持该强度,不会聊着聊着漂移回正常语速,直到你再次切换或会话结束。完整规则定义在 skills/caveman/SKILL.md。
两种情况,它拒绝省话
情况一:该说清楚时,它自动恢复正常表达。安全警告、不可逆操作确认、多步骤指令、或压缩本身会造成歧义时,Auto-Clarity 机制会先切回正常表达,讲完关键部分再恢复压缩。删表、清库这类操作,你永远拿到的是一整句警告,而不是电报体。
情况二:技术内容一个字都不改。代码块、命令、API 名、错误串逐字节保留;数字和单位精确;not/never/except这类改变语义的词绝不省略。压缩的从来只是叙述性文字,而且压缩的是风格、不是语言——你用中文提问,永远得到中文回答。
省了多少,三个办法验
| 办法 | 命令 | 说明 |
|---|---|---|
| 会话内查看 | /caveman-stats | 读取会话日志,输出 token 记录 |
| 自 A/B | 同一任务开/关各跑一次 | 对比服务商账单页用量,最硬的证据 |
| 深度分析 | caveman learn | 扫描本地代理历史,按 token 消耗排名"token 黑洞" |
除了验证,装完还白得几个日常命令(定义在 commands/ 目录):
/caveman-commit:生成单行 Conventional Commit 提交信息/caveman-review:一行一条、可直接执行的代码评审意见/caveman-compress <文件>:压缩 Markdown 记忆文件,自动备份原文,五个基准文件平均减 46%
你可能想问的四件事
代码和报错会不会被改坏?不会。代码块、命令、API 名、错误串逐字节保留,只动叙述文字。
它能压输入 token 吗?Skill 本身只压输出。输入侧压缩是 Caveman Proxy 的事,它压工具结果、日志和文件上下文,属于同一仓库的另一组件。
wenyan 是中文专用吗?是。三个 wenyan 模式专门面向中文输出,英文场景继续用 lite / full / ultra。
聊多了模式会自己变回去吗?不会。选定模式持续生效到会话结束或手动/caveman off,没有多轮对话后的风格漂移。
收尾:按账单定开关
长解释、长配置、长会话任务开 Caveman;一句话问答和按次计费的任务关。同一任务开/关各跑一次,拿账单总额说话——这是唯一不会骗你的数字。
【免费下载链接】caveman🪨 why use many token when few token do trick. Viral skill + proxy for coding agents that cuts 65% of tokens by talking like a caveman.项目地址: https://gitcode.com/GitHub_Trending/caveman1/caveman
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考