Phistory:追踪 Claude Code、Codex 等 Coding Agent 系统提示词变化的 GitHub 项目
大家好,这里是「代码简单说」。
今天看到一个比较有意思的 GitHub 项目:Phistory。
如果你平时在使用 Claude Code、Codex、DeepSeek Harness、Kimi Code、opencode 等 Coding Agent,那么这个项目值得关注。
它做的事情非常简单,但对于研究 AI Agent 的人来说非常有价值:
持续记录热门 Coding Agent 的 System Prompt,并对比不同版本之间到底发生了什么变化。
项目地址:
GitHub:https://github.com/WEIFENG2333/phistory
在线查看器:https://phistory.cc/
一、Phistory 是什么?
Phistory 可以理解成一个专门记录Coding Agent System Prompt 历史版本的项目。
目前它已经覆盖多个热门 Coding Agent,包括:
- Claude Code
- Codex CLI
- DeepSeek Harness
- Antigravity CLI
- Grok Build
- MiniMax Code
- Kimi Code
- MiMo Code
- OpenClaw
- Hermes Agent
- Kimi CLI
- opencode
- Pi
- Oh My Pi
也就是说,我们不仅可以看到这些工具现在是怎么工作的,还可以进一步观察:
它们以前是怎么工作的。
例如一个 Coding Agent 从 1.0 版本升级到 1.1、1.2、1.3 后,它的 System Prompt 可能增加了新的工具说明、权限规则、代码修改策略、用户确认规则等。
这些变化通常不会直接出现在版本更新日志里面。
但 Phistory 会把它们记录下来。
二、最有意思的是 System Prompt Diff
打开:
https://phistory.cc/
可以看到 Phistory 提供了一个网页查看器。
它的核心功能就是:
对比不同版本的 Prompt。
例如选择 Claude Code,可以看到不同版本的 System Prompt 快照。
这些 Prompt 并不是简单的一段文本,而是包含很多 Agent 工作机制,例如:
- System Prompt
- Tools
- Tool 使用规则
- 权限检查
- 文件操作策略
- 用户确认机制
- Coding Workflow
- Runtime Instructions
- 模型行为约束
- 默认行为
所以它实际上有点像:
Coding Agent 的版本控制系统。
Git 记录的是代码变化,而 Phistory 记录的是 Agent 的「行为规则」变化。
三、为什么 System Prompt 的变化值得研究?
很多人使用 Claude Code、Codex 或其他 Coding Agent 时,关注的主要是模型本身。
例如:
GPT-5.x 到底强不强?
Claude 新版本写代码是不是更好了?
DeepSeek Harness 为什么突然变得更好用了?
但 Coding Agent 的最终表现,并不完全由模型决定。
实际上可以简单理解成:
模型能力 + System Prompt + Tools + Agent 策略 + Runtime
共同决定了最终的使用体验。
因此,一个 Agent 即使底层模型没有发生明显变化,只要 System Prompt 和工具调用策略进行了调整,实际表现也可能出现明显变化。
Phistory 的价值就在这里。
它让我们可以把这些变化直接拿出来比较。
四、可以观察哪些变化?
通过 Phistory,可以重点观察几个方面。
1. Agent 如何定义自己的工作方式
例如:
- 如何分析用户需求
- 什么时候应该修改代码
- 什么时候应该先读取文件
- 如何进行代码搜索
- 如何验证修改结果
- 如何处理错误
这些通常都属于 Agent 的行为规范。
2. Tool 使用方式如何变化
Coding Agent 最大的特点之一就是拥有大量工具。
例如:
Read Write Edit Search Bash Git Browser不同版本可能会改变这些工具的使用规则。
例如:
修改代码之前必须先读取相关文件。
或者:
执行某些高风险命令之前需要获得用户确认。
这些看起来只是几句话,但实际上会直接影响 Agent 的行为。
3. 权限和确认机制
这是我觉得比较值得关注的一部分。
随着 Coding Agent 能力越来越强,它可以执行:
- 删除文件
- 修改代码
- 安装依赖
- 执行 Shell 命令
- 修改配置
- Git 操作
因此权限控制越来越重要。
通过不同版本的 Prompt Diff,可以看到这些规则是在什么时候加入或者修改的。
4. 默认模型行为
某些 Agent 会针对不同模型、不同模式提供不同 Prompt。
Phistory 也会把这些变体保存下来。
例如 Codex:
uv run phistory capture\--latest\--agentscodex\--variantsdefault,gpt-5.5,gpt-5.6这样就可以分别观察不同模型配置下的 Prompt。
五、Phistory 是怎么实现的?
这个项目的实现方式也比较有意思。
它不是简单地去 GitHub 搜索 Prompt。
Phistory 会安装对应的具体 CLI 版本,然后通过:
claude-tap
运行对应的快照。
项目地址:
https://github.com/WEIFENG2333/claude-tap
然后抓取包含 System Prompt 的 HTTP 请求。
一个关键点是:
它不会调用真实模型服务。
抓取到的数据最终会保存到类似下面的目录:
captures/ └── <agent>/ └── <version>/ └── variants/ └── <variant>/ ├── prompt.md ├── trace.jsonl └── meta.json其中:
prompt.md
主要保存最终提取出来的 Prompt。
方便直接阅读和 Diff。
trace.jsonl
保存抓取过程中的请求信息。
meta.json
保存版本、变体等元数据。
这种目录结构其实非常适合做历史版本研究。
六、Claude Code 还有额外的静态 Prompt 提取
对于最近的一些 Claude Code 版本,Phistory 还会进一步从安装包中提取疑似静态 Prompt 的字符串。
这些内容会保存到:
captures/<agent>/<version>/static/比较有意思的是:
候选文件会保留原始内容。
这样以后如果项目改进 Prompt 匹配规则,就不需要重新安装所有历史版本。
从工程角度来说,这也是比较合理的数据归档设计。
七、GitHub Actions 每小时自动更新
Phistory 并不是一个需要人工维护的静态仓库。
项目使用 GitHub Actions:
每小时检查一次已经配置的 Coding Agent 是否有新版本。
如果发现新版本,就自动:
- 获取新版本
- 安装对应 CLI
- 抓取 Prompt
- 保存快照
- 更新索引
- 提交到 GitHub
因此它实际上形成了一个持续增长的 Prompt 历史数据库。
截至2026 年 8 月 14 日,最近一次抓取时间为:
2026-08-14 22:52 UTC八、目前已经收录多少版本?
项目目前的数据量已经相当可观。
| Agent | 最新版本 | 版本数 | 快照数 |
|---|---|---|---|
| Claude Code | 2.1.233 | 387 | 387 |
| Codex CLI | 0.147.0 | 74 | 80 |
| DeepSeek Harness | 0.1.0-rc.6 | 5 | 21 |
| Antigravity CLI | 1.1.13 | 27 | 27 |
| Grok Build | 1.0.4 | 129 | 129 |
| MiniMax Code | 3.0.65 | 29 | 29 |
| Kimi Code | 0.36.1 | 62 | 62 |
| MiMo Code | 0.1.12 | 12 | 12 |
| OpenClaw | 2026.7.1-2 | 69 | 69 |
| Hermes Agent | v2026.8.13 | 23 | 23 |
| Kimi CLI | 1.49.0 | 21 | 21 |
| opencode | 1.18.18 | 103 | 103 |
| Pi | 0.84.2 | 41 | 41 |
| Oh My Pi | 17.3.4 | 59 | 59 |
其中 Claude Code 已经积累了387 个版本。
对于想研究 Coding Agent 演进的人来说,这已经是一份相当有价值的数据。
九、怎么在本地运行?
如果只是查看 Prompt,我个人更推荐直接打开:
https://phistory.cc/
不需要安装任何东西。
如果想参与开发或者自己重新抓取,可以使用项目提供的开发环境。
首先安装依赖:
uvsync--all-groups然后抓取最新版本:
uv run phistory capture\--latest\--agentsclaude-code,codex,dsh,antigravity,grok,minimax-code,kimi-code,mimo,openclaw,hermes,kimi,opencode,pi,omp如果只想抓取 Codex:
uv run phistory capture\--latest\--agentscodex\--variantsdefault,gpt-5.5,gpt-5.6十、还可以回填历史版本
如果希望研究某个 Agent 在一段时间内是怎么变化的,可以使用:
uv run phistory backfill claude-code\--from2.1.113\--tolatest例如从 Claude Code2.1.113一直回填到最新版本。
这样就可以获得完整的历史 Prompt 数据。
十一、还可以重新生成项目文件
项目提供了几个生成命令。
重新生成索引:
uv run phistory render-index重新生成静态网页:
uv run phistory render-site重新提取最近捕获的 Claude Code 静态 Prompt:
uv run phistory extract-static claude-code\--latest-captured10对于想研究这个项目源码的人来说,这几个命令也比较值得看。
十二、这个项目真正有价值的地方
我觉得 Phistory 有意思的地方并不是「收集 Prompt」这么简单。
真正有价值的是:
它把 Coding Agent 的演进过程变成了可以被观察、比较和研究的数据。
以前我们只能看到:
Claude Code v1 Claude Code v2 Claude Code v3然后根据使用体验判断:
「好像变强了。」
现在可以进一步问:
到底改了什么?
例如:
Version A ↓ 新增 Tool ↓ 修改 System Prompt ↓ 增加权限检查 ↓ 调整代码修改策略 ↓ Version B这就从「感觉变强了」变成了可以进行 Diff 的工程分析。
十三、对于 AI Agent 开发者有什么参考价值?
如果你自己也在开发 Agent,这个项目尤其值得研究。
例如你正在设计一个 Coding Agent,可以观察其他项目是怎么处理:
- System Prompt 组织
- Tool Description
- Tool Calling
- 权限系统
- 文件修改
- 命令执行
- 用户确认
- 错误恢复
- Agent Workflow
- Context 管理
这实际上就是在观察整个 Coding Agent 行业的设计趋势。
当然,这里的内容更适合用于学习和研究 Agent 设计思路,而不是简单复制某个项目的 Prompt。
十四、我最推荐的使用方式
如果你平时经常使用 Claude Code、Codex、DeepSeek Harness 等工具,可以把 Phistory 加入自己的开发资料库。
遇到 Agent 行为发生明显变化时,可以先看看:
当前版本 ↓ 上一版本 ↓ Prompt Diff ↓ Tools Diff ↓ 策略变化然后再结合实际使用体验进行分析。
这样能够更准确地判断:
到底是模型变了,还是 Agent 的 Prompt / Tool / 策略变了。
十五、总结
Phistory 是一个比较小众,但非常适合 AI 开发者研究的 GitHub 项目。
它做的事情可以概括成一句话:
持续追踪主流 Coding Agent 的 System Prompt,并保存不同版本之间的变化。
目前已经支持:
- Claude Code
- Codex
- DeepSeek Harness
- Antigravity
- Grok Build
- MiniMax Code
- Kimi Code
- MiMo Code
- OpenClaw
- Hermes
- Kimi CLI
- opencode
- Pi
- Oh My Pi
而且项目会通过 GitHub Actions 自动追踪新版本。
如果你最近正在研究AI Agent、Coding Agent、System Prompt、Tool Calling、Agent Engineering,这个项目非常值得收藏。
项目地址:
https://github.com/WEIFENG2333/phistory
在线 Prompt 查看器:
https://phistory.cc/
如果你想研究 Claude Code、Codex 等 Coding Agent 到底是如何一步步演变到现在的,Phistory 提供了一个非常直观的入口。