硬盘满了?Czkawka 免费磁盘清理工具箱教程:5 分钟快速清理重复文件与垃圾
【免费下载链接】czkawkaMulti functional app to find duplicates, empty folders, similar images etc.项目地址: https://gitcode.com/GitHub_Trending/cz/czkawka
硬盘满了、重复文件越堆越多、照片备份一团乱?Czkawka 是一款用 Rust 编写的免费开源磁盘清理工具箱,内置重复文件查找、相似图片识别、大文件搜索等 14 项扫描工具。它完全离线运行,不联网、不收集数据,配合缓存机制,第二次扫描同一目录会快很多。无论你想腾出空间的普通用户,还是想把定期清理写成脚本的开发者,装一套就够。
一、先看它适不适合你
- 定位:按内容找出重复文件、相似图片、大文件的本地磁盘清理工具箱
- 平台:Windows 10+、macOS、Linux(Ubuntu 22.04+)、FreeBSD、Android
- 协议:核心库与命令行是 MIT,Krokiet 整体为 GPL-3.0,图片素材 CC BY 4.0
- 前端:四个——Krokiet(当前推荐)、Czkawka GTK(12.0 后停更)、czkawka_cli(命令行)、Cedinia(Android)
四个前端的扫描逻辑都来自同一个核心库 czkawka_core,结果保持一致。
二、5 分钟跑起来并验证
预编译二进制,最省事:从发布页下载对应平台的包,无需安装任何依赖,解压直接运行。官方提供 Windows 10/11、macOS 和 Ubuntu 22.04+ 的二进制。
cargo 一键安装:
cargo install krokiet --locked源码编译,最可自定义:可以按需启用 HEIC、RAW 等可选特性。
git clone https://gitcode.com/GitHub_Trending/cz/czkawka cd czkawka cargo build --release --bin krokiet怎么确认装好了:图形界面打开后能正常显示左侧工具列表和扫描按钮即可;命令行用户运行czkawka_cli --help,看到 14 个工具名就算成功。
三、挑三个最实用的功能拆讲
3.1 重复文件查找:三层过滤,大目录也快
它能做的事:按文件内容找出完全相同的副本,分组展示,留一份删其余。
怎么做的:先按文件大小分组,大小唯一的文件直接排除;再对首尾 4 KB 计算预哈希,快速筛掉不匹配的;最后算全量哈希精确匹配,默认 Blake3 算法,默认只查 8 KB 以上的文件(-m可调)。
怎么用:打开 Krokiet 的 Duplicates → 添加目录 → 扫描,结果按组展示。检查方式有四种可选,正式去重选 Hash:
| 检查方式 | 速度 | 准确度 | 建议用途 |
|---|---|---|---|
| Name | 最快 | 误报多 | 只作快速参考 |
| Size | 快 | 几乎总有误报 | 粗筛 |
| Size + Name | 快 | 不可靠 | 粗筛 |
| Hash | 稍慢 | 接近 100% | 正式去重 |
适合场景:下载目录里多份同名安装包、多个项目间复制过去的依赖文件。
3.2 相似图片识别:专治"看起来一样"
它能做的事:把并非完全相同、但内容相近的图片归为一组——分辨率不同、加了水印、裁过边的都能认出来。
怎么做的:对每张图计算感知哈希(默认 Gradient 算法、16 级哈希),再比较哈希距离,默认阈值 5,越小越严格;缩略图对原图这类高相似场景可降到 0-3。
怎么用:打开 Similar Images → 选照片目录 → 扫描,按组浏览,每组保留最佳版本。
适合场景:手机备份、云盘同步下来的照片库,上万张图的库典型一次能筛出数百到上千张近似重复图。
3.3 大文件搜索:一眼找到最占地方的家伙
它能做的事:按体积降序列出目录里最大的文件,默认展示前 50 个。
怎么做的:递归遍历后按大小排序,可按扩展名宏(IMAGE、VIDEO 等)过滤,只看你关心的类型。
怎么用:打开 Big Files → 选目录 → 扫描,前 50 个大文件和各自体积一目了然。
适合场景:不知道磁盘为什么满,一次扫描定位"空间大户"。
四、两个能直接复现的场景
场景一:老硬盘迁移,先去重再拷贝
背景:老硬盘快满了,准备把数据挪到新盘,想少拷一点。
步骤:老盘目录加入 Included Paths → 新盘备份目录设为 Reference path(受保护、不会被删)→ Hash 模式跑重复扫描 → 预览重复组确认无误删 → 移入回收站。
效果:500 GB 左右的数据盘典型能释放几十到上百 GB,迁移时的拷贝量随之减少。
场景二:找大文件,手动定位空间大户
背景:磁盘占用突然上涨,不知道是谁吃掉了空间。
步骤:命令行运行czkawka_cli big -d /data -x VIDEO -n 50→ 列出体积前 50 的视频并显示大小 → 逐个确认 → 把确认不需要的大文件移走或归档到冷存储盘。
效果:1 TB 的盘一次扫描典型能找出合计几十 GB 的大视频,挪走之后明显轻松。
五、从一次性用到定期跑
缓存(收益最大):默认开启,Linux 下位于~/.cache/czkawka/,所有前端共享。文件哈希在第一次扫描后写入缓存,第二次扫同一目录明显更快。
排除列表:把系统目录和重要数据加入排除目录,CLI 对应-e参数;也能用 glob 模式(-E "*/.git"),防止误扫重要数据。
最小文件大小:-m控制参与去重的文件下限,默认 8192 字节。小文件不占地,跳过更省时间。
把清理固化成定时任务,每周日把家目录里的临时文件移入回收站:
#!/bin/bash # crontab: 0 4 * * 0 每周日 4 点,扫描家目录并移入回收站 czkawka_cli temp -d "$HOME" -e "$HOME/Backups" -y更多参数组合见 CLI 文档。
六、别急着提问,先查这 4 条
Q1:怕误删重要文件怎么办?把重要目录设为 Reference path(-r),其中的文件只参与对比,任何操作都不会删它。执行前先加-Q干跑预览,确认无误再用-y移入回收站,最后才考虑彻底删除 💡
Q2:相似视频打不开、报错?该工具运行时依赖 ffmpeg。先安装并加入 PATH:Linux 用sudo apt install ffmpeg,Windows 用choco install ffmpeg,macOS 用brew install ffmpeg。
Q3:HEIC 或 RAW 扫不出来?预编译包默认不含这些格式。装好 libheif / libraw 后,从源码加--features "heif,libraw"重新编译即可。
Q4:第一次扫描特别慢?正常现象,缓存还没建立。中途停止扫描也会把已算的哈希写入缓存,第二次扫同一目录会快很多。
更多问题查官方 FAQ(来自 1200+ 条 issue 报告的整理)和 CLI 参数手册。
结尾
现在就可以挑一个文件最多的目录(下载或桌面),用 Hash 模式扫一遍重复文件,先预览再移入回收站,看看能省出多少空间。日常用 Krokiet 界面,定期清理交给一行 CLI。
【免费下载链接】czkawkaMulti functional app to find duplicates, empty folders, similar images etc.项目地址: https://gitcode.com/GitHub_Trending/cz/czkawka
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考