换输入法总丢词库?3 分钟上手深蓝词库转换,让词库跟着你走
【免费下载链接】imewlconverter”深蓝词库转换“ 一款开源免费的输入法词库转换程序项目地址: https://gitcode.com/gh_mirrors/im/imewlconverter
换输入法最让人心疼的,不是重新适应键位,而是攒了好几年的词库一夜清零。深蓝词库转换是一款开源免费的输入法词库转换工具,支持 20 多种输入法格式互相转换,覆盖 Windows、macOS、Linux,让词库真正属于你。读完本文,你就能在 3 分钟内完成人生第一次词库转换。
📌 一个真实的小故事:小周的词库"搬家"记
小周用了八年搜狗拼音,词库里躺着他给客户写方案时攒下的几百个专业术语。上周他换了一台 Linux 笔记本,装上了 Rime 输入法,结果发现:搜狗的词库文件(.scel)Rime 根本不认。手动把几百个词一个个敲回去?光是想想就头大。
最后他花了十分钟:用工具把 .scel 一键转成 Rime 的 .yaml 词库,导入、重启输入法,熟悉的词条全部回来了。
如果你也有过类似经历——换电脑、换输入法、手机和电脑词库对不上号——这篇文章就是为你写的。
🔍 先看清"病根":词库为什么会被锁死?
输入法词库格式五花八门,用户常常栽在这三个坑里:
- 格式封闭:搜狗的 .scel、百度的 .bdict、QQ 的 .qpyd,都是各家私有的二进制格式,除了自家输入法,别的软件根本读不懂。
- 格式割裂:同样是"拼音词库",Windows 文本格式、macOS 的 .plist、Rime 的 .yaml 写法完全不一样。
- 迁移成本高:手机端和电脑端词库互不通用,换一次输入法往往意味着从头积累。
这正是"词库转换"要解决的核心问题:把 A 输入法的词库,翻译成 B 输入法能读懂的格式,词条、拼音、词频一个都不少。
🧰 能力速览:一张表看懂它能干什么
深蓝词库转换支持超过 20 种格式的导入导出,覆盖拼音、五笔、郑码、注音、二笔等多种编码体系:
| 输入法系列 | 常见格式 | 可导入 | 可导出 |
|---|---|---|---|
| 搜狗拼音 | .scel / .txt / .bin | ✅ | ✅ |
| QQ 拼音 | .qpyd / .qcel / .txt | ✅ | ✅ |
| 百度拼音 | .bdict / .txt / .bcd | ✅ | ✅ |
| Rime(小狼毫/鼠须管) | .yaml | ✅ | ✅ |
| 微软拼音 / 微软五笔 | 自学习词库、自定义短语 | ✅ | ✅ |
| macOS 系统拼音 | .plist | ✅ | ✅ |
| 谷歌 / 紫光 / 拼音加加 | .txt | ✅ | ✅ |
| 自定义格式 | .txt | ✅ | ✅ |
除了"导入 A、导出 B",它还能在转换时顺手完成简繁体转换、按字数或词频过滤、去重、生成拼音/五笔编码等操作,相当于一条带加工能力的转换流水线。
🚀 两条上手路线:图形界面 or 命令行
路线一:新手友好,图形界面拖一拖
Windows 图形界面位于src/IME WL Converter Win/,macOS 原生版位于src/ImeWlConverterMac/(基于 Avalonia UI)。打开程序后只要三步:
- 把词库文件拖进"源文件"区域(一次可拖多个);
- 选好目标输入法格式;
- 点击转换,导出即可。
全程不用碰命令行,适合第一次尝试的用户。
路线二:进阶高效,命令行批量处理
命令行工具位于src/ImeWlConverterCmd/,需要 .NET 10.0 环境。先克隆并构建:
git clone https://gitcode.com/gh_mirrors/im/imewlconverter cd imewlconverter dotnet build src/ImeWlConverterCmd把搜狗 .scel 转成 Rime 格式,一条命令:
dotnet src/ImeWlConverterCmd/bin/Debug/net10.0/ImeWlConverterCmd.dll \ -i scel -o rime -O 我的词库.yaml 搜狗词库.scel想查看当前版本支持的全部格式,运行--list-formats即可。
⚡ 实战对照:三个场景,转换前后看得见
场景一:搜狗词库 → Rime,换输入法搬家
- 用前:手动重录几百个专业词,约需 1~2 小时;
- 用后:一条命令几秒钟出结果,导入即用,词频原样保留。
场景二:手机 QQ 拼音 → 电脑输入法
把手机导出的 .qpyd 分类词库转成电脑输入法可导入的文本格式,从此手机里攒的词也能在电脑上用,告别两头各练一遍。
场景三:词库瘦身提效
词库动辄几十万条,夹杂大量英文、数字、单字干扰词。用过滤器一键精简:
dotnet ImeWlConverterCmd.dll -i scel -o sgpy -O 精简词库.txt \ -f "len:2-6|rm:eng|rm:num" 大词库.scel| 优化项 | 优化前 | 优化后 |
|---|---|---|
| 词条数 | 20 万 | 约 8 万 |
| 候选干扰 | 多 | 明显减少 |
| 输入跟手度 | 一般 | 显著提升 |
🛠 进阶技巧:把转换玩出效率
技巧一:批量转换整个文件夹。输出路径以/结尾时,工具会把每个输入文件逐一转换到目标目录,而不是合并成一个文件:
dotnet ImeWlConverterCmd.dll -i scel -o ggpy -O ./output/ *.scel技巧二:过滤器自由组合。过滤条件支持len(字数范围)、rank(词频范围)以及rm:eng、rm:num、rm:space、rm:pun(分别移除含英文、数字、空格、标点的词条),用|串联,按需裁剪词库。
技巧三:让 LLM 帮你补词频。部分格式导出的词库没有词频,src/ImeWlConverter.Core/WordRank/目录下提供了基于 LLM 的词频生成器,能把"没排序"的词库变成"按使用频率排列"的优质词库。
另外,如果你有公司内部造字、特殊编码等需求,自定义编码规则的使用方法可参考docs/custom-code-rules.md。
❓ 高频疑问速答
Q1:转换出来的词库是乱码怎么办?先确认源文件编码。搜狗等格式默认多为 GBK,在图形界面中切换编码选项重新转换通常就能解决。
Q2:命令行提示"检测到旧的参数格式"?v3.0.0 起参数改为 GNU 风格,旧写法-i:scel需换成-i scel,迁移说明见docs/MIGRATION.md。
Q3:大词库转换很慢怎么办?先用过滤器删掉冗余词条再转换;若内存不足,把大文件拆成几份分批处理。
Q4:能保留词频信息吗?源格式本身带词频时(如搜狗 .scel)会尽量保留;源文件没有词频时,可以用 LLM 词频生成功能补上。
Q5:支持哪些系统?Windows(图形界面 + 命令行)、macOS(原生界面 + 命令行)、Linux(命令行)均支持。
✅ 现在就动手:四步行动清单
- 克隆仓库并构建命令行工具,约 2 分钟完成;
- 备份原始词库,先拿一个小词库试转换;
- 按本文示例完成第一次正式转换,并在目标输入法里导入验证;
- 把常用命令存成脚本,以后换设备、换输入法,一条命令搞定。
词库是你多年输入的积累,值得被好好保管。花几分钟学会"词库转换",以后无论怎么换输入法、换设备,你的词库都能跟着你走——这大概是性价比最高的一笔"输入法投资"。
关键词清单:核心关键词——词库转换;长尾关键词——输入法词库转换工具使用教程、搜狗词库转Rime方法、scel转txt命令、词库批量转换命令行、词库过滤精简技巧。
【免费下载链接】imewlconverter”深蓝词库转换“ 一款开源免费的输入法词库转换程序项目地址: https://gitcode.com/gh_mirrors/im/imewlconverter
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考