免费本地AI改写:claudish-to-english的Ollama模型选择清单(从gemma4到轻量替代)
【免费下载链接】claudish-to-english项目地址: https://gitcode.com/gh_mirrors/cl/claudish-to-english
claudish-to-english是一款免费的 Claude Code 插件,通过本地 Ollama 大模型把 AI 助手满屏的"黑话"自动改写成大白话,默认模型为 gemma4:26b-mlx,全程本地运行、不花一分钱 API 费。本文给出一份 Ollama 模型选择清单:从默认的 gemma4 到低配机可用的轻量替代,并附最快配置方法和排查指南。
一、它到底做了什么:只改"显示",不动原文 📝
理解模型怎么选,先要知道这个插件的工作方式:
- 显示钩子:每条 AI 回复生成完毕后,本地模型把全文重写成通俗版本,默认以
💬 In plain English:块追加在原文后面(append模式),也可以选择完全替换(replace模式) - Markdown 钩子(可选):AI 写入/编辑
.md文件时,顺手把文档改写成白话版,默认生成NAME.plain.md兄弟文件,不碰原文件 - 失败即放行(fail-open):模型没拉取、Ollama 没启动、请求超时……任何环节出问题,你都只会看到 AI 的原始回复,绝不会吞掉或改写坏答案
也就是说,模型选错了、机器跑不动了,最坏的结果就是"看到原文",没有风险成本。核心逻辑分别在 rewrite.sh 和 rewrite-md.sh 中,钩子注册见 hooks/hooks.json。
二、3步搭好本地 Ollama 改写环境 📦
模型清单生效的前提是 Ollama 就绪。以 macOS 为例(Windows 步骤见 README.md 中的 Windows setup 章节):
- 安装并启动 Ollama:
brew install ollama,然后运行ollama serve - 拉取模型:例如
ollama pull gemma4:26b-mlx(约 17 GB,请按你的内存选更小的) - 预热一次:
ollama run gemma4:26b-mlx "hi"——首次调用是慢速冷加载,预热后体验才正常
⚠️ 如果本地模型没就绪,插件对文字什么都不做——这是设计使然,不是 bug。插件首次跳过后会在屏幕上一行字告诉你原因(
CLAUDISH_NOTICE=0可静音)。
三、Ollama 模型选择清单:按内存对号入座
CLAUDISH_MODEL可以指向任何已拉取的 Ollama 标签,默认值只是起点。对照下表选:
| 模型标签 | 特点 | 适合谁 |
|---|---|---|
gemma4:26b-mlx | 默认模型,~17 GB,Apple 芯片 MLX 构建,约 60 token/s | Mac 主力机(建议 24 GB+ 内存) |
gemma4:26b | 同尺寸的非 MLX 通用标签 | Windows / Linux 高配机 |
llama3.2:3b | 轻量级,秒级响应 | 8 GB 内存入门机、怕超时的长消息 |
qwen3-30b | 中大型,改写质量更高 | 长文档、Markdown 文件改写 |
两个关键坑位:
- ⚡MLX 标签是 macOS 专属:Windows 上
gemma4:26b-mlx根本跑不起来,保持默认会导致每条消息都静默跳过改写,必须把CLAUDISH_MODEL换成普通标签 - 模型名必须精确匹配:如果
CLAUDISH_MODEL指向一个未拉取的模型,每次改写都会被跳过,并出现一次性提示
四、最快配置方法:一个变量切换模型
所有配置都通过CLAUDISH_*环境变量控制,推荐写在~/.claude/settings.json的env块里(不要改插件缓存里的 hooks/hooks.json,更新时会被覆盖):
{ "env": { "CLAUDISH_MODEL": "gemma4:26b-mlx", "CLAUDISH_MODE": "append" } }不想改文件?启动前临时指定一次也行:
CLAUDISH_MODEL=llama3.2:3b claude注意两点:
- 改完
env需要重启 Claude Code才生效(变量在启动时读取) - 多项目共用配置请放在优先级最高的那份 settings 里,
env块不会跨层级合并
五、轻量替代怎么选:速度、质量、体积三角 ⚖️
选模型的本质是权衡三个维度:
| 维度 | 大模型(gemma4 26b / qwen3-30b) | 轻量模型(llama3.2:3b) |
|---|---|---|
| 响应速度 | 长消息明显等待,长文档 30–120s | 快,几乎无感 |
| 改写质量 | 高,术语解释更到位 | 够用,但弱模型可能"越改越糙" |
| 内存门槛 | 高(16–32 GB) | 低(8 GB 可跑) |
实操建议:
- 日常对话改写:轻模型完全够用,显示钩子的 LLM 超时默认 45 秒,小模型很少碰线
- Markdown 长文档改写:大模型按 60 token/s 估算一篇长规划文档要 30–120 秒,文件钩子默认允许 150 秒(
CLAUDISH_MD_TIMEOUT),上限 180 秒;文档特别长可以调高这两个值,或干脆换小模型保速度 - 推理类模型别开思考:插件已对 ollama 请求发送
"think": false,省掉你看不到也派不上用场的推理耗时,保持默认即可
六、改写没生效?按这个顺序排查 🔍
插件"失败即放行",所以最常见的症状是"好像没反应"。排查顺序:
- 看一次性提示:屏幕底部/系统消息会写明跳过原因(模型未拉取、超时、Ollama 不可达)
- 模型没拉取→
ollama pull <你的模型标签> - Windows 上用了 MLX 标签→ 改
CLAUDISH_MODEL为普通标签 - 超时→ 换小模型,或调高
CLAUDISH_TIMEOUT/CLAUDISH_MD_TIMEOUT - 想深挖→
CLAUDISH_DEBUG=1后查看$TMPDIR/claudish-to-english/debug.log - 临时暂停/恢复:
touch ~/.claude/claudish-off立即暂停改写,删除该文件即恢复,会话中即时生效
七、相关文件速查
| 文件 | 作用 |
|---|---|
| README.md | 完整文档:安装、配置、隐私说明 |
| rewrite.sh | 显示改写钩子(逐块缓冲、收尾调用一次模型) |
| rewrite-md.sh | Markdown 文件改写钩子(可选、按目录启用) |
| providers.sh | 提供方层:ollama / anthropic / openai 默认模型与请求逻辑 |
| hooks/hooks.json | 钩子注册与超时配置(60s / 180s) |
| CHANGELOG.md | 版本变更记录 |
总结:三句话选对你的 Ollama 模型
- Mac 用户:保持默认
gemma4:26b-mlx,内存不够就换小标签 - Windows / Linux 用户:必须设置
CLAUDISH_MODEL,从gemma4:26b起步 - 低配机器:直接
llama3.2:3b,速度优先,改写质量依然够用
改坏了不怕——这个插件永远兜底显示原文,放心试。
【免费下载链接】claudish-to-english项目地址: https://gitcode.com/gh_mirrors/cl/claudish-to-english
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考