Czkawka 重复文件清理教程:3 步装好,揪出重复和"长得像"的文件
【免费下载链接】czkawkaMulti functional app to find duplicates, empty folders, similar images etc.项目地址: https://gitcode.com/GitHub_Trending/cz/czkawka
Czkawka 是一款免费的重复文件清理工具:它按文件内容而不是文件名找重复,还能识别分辨率不同、带水印的类似图片,以及空文件夹、失效快捷方式和损坏文件。一台用了几年的电脑,扫一次通常能找出几 GB 到几十 GB 可释放的空间,而且它全程不联网、不收集任何信息。
用 3 个例子判断它能不能找到你的重复文件
对比内容而不是文件名,重命名的副本跑不掉把report.docx和report(1).docx拷到两个盘,名字不同它照样认出来——重复文件查找基于文件大小加哈希比对,内容一致才归到同一组,不会像"找同名文件"的小工具那样漏掉换过名字的副本。
缩图再比对,带水印的截图也算相似similar_images 模块会把图片缩成小尺寸再比对,所以裁剪、缩放、加过水印的照片都能算成相似。整理照片库时,这个能力比纯哈希比对实用得多。
14 种扫描任务一个程序带齐,少装 3 个工具除了重复文件,它还覆盖空文件夹、大文件、零字节文件、临时文件、相似视频、重复音乐、失效符号链接、损坏文件、扩展名与内容不符的文件、Exif 清理和视频优化。清一种垃圾配一个新工具的麻烦可以省掉。
3 步把工具装到电脑上,下载即用
下载预编译版,解压运行 3 步进主界面官方提供 Windows、macOS、Linux 的预编译版本,桌面端现在主推的界面叫 Krokiet(基于 Slint,三个平台行为一致)。从官方发布页下载对应系统的压缩包,解压、运行主程序就完成安装,没有额外步骤。注意:相似视频功能依赖 ffmpeg,用得到就先装一个。
老 GTK 版 Czkawka 还能用,但新功能已停更老一代 GTK 4 界面就是 Czkawka 这个名字本身,12.0 是它的最后版本,官方不再提供新安装包。手头有的话能继续跑,但视频优化等新功能只在 Krokiet 上。
命令行版装好,扫描结果能存成文件做定时任务有 Rust 环境的话,git clone https://gitcode.com/GitHub_Trending/cz/czkawka拉下仓库,执行cargo install krokiet --locked装桌面版;或cargo install --path czkawka_cli --locked装命令行版。命令行版配合-f参数可以把结果写进文件,方便接每周定时任务,参数细节见 czkawka_cli 使用说明。
按 4 类数据挑扫描方式,避免全盘乱扫
同一个"找重复"按钮,处理不同数据时该用的参数完全不同,照搬一遍很容易要么漏报要么误报。
文档和办公文件:按哈希比对加最小体积过滤,结果不被小文件淹没扫描目录选"文档""下载",重复判定选按内容(hash),最小文件大小设 5MB 左右——1KB 的小图标重复 30 份删完也省不出 1MB,还会把结果列表淹掉。跑完先目测一遍分组是否合理。
📷 照片:开相似图片识别,阈值拉到 90 以上防误删手机照片导入后常同时留着原图和缩略图,再叠加截图、压缩转发版,哈希比对抓不到这些,必须用 similar_images。相似度阈值建议设高一点(90 以上),宁可漏报,也别把两张构图相同但内容不同的照片一起删了。摄影库每月跑一次比较合适。
🎵 音乐:有标签按标签比,没标签按内容比same_music 模块有两条路:同一首歌的 mp3 和 flac 版本如果带标签,按标签比对又快又准;无标签的录音则按音频内容比对。音乐库超过几百首时,先用标签模式跑一遍并把结果存下来,再决定删哪些。
🎬 视频:先装 ffmpeg 再扫,1GB 以上的先列出来相似视频按画面帧比对,没装 ffmpeg 会直接报错。视频重复最占空间(一部 1080p 电影 2GB 起),扫描也最慢,建议单独挑个晚上跑;或者先用"大文件"功能把 1GB 以上的视频列出来,人工过一遍再决定。
开发目录:排除 .git 和构建产物,专找资源文件代码仓库里大量文件天然重复(依赖库、target 构建目录),把*/.git、*/node_modules加进排除列表,重点找图片资源、导出数据这类真正值得清理的东西。
第一次扫描从小目录开始,先预览再删除
选 2GB 小目录试跑,学会在结果里留一份删其余第一次别选整个磁盘。挑一个 2GB 上下的目录跑重复文件扫描,熟悉结果列表长什么样、每组里怎么挑留哪份,再逐步扩大到整个磁盘。
第二次扫描走缓存,速度比第一次快很多Czkawka 会把扫过的文件指纹写进本地缓存(Linux 在~/.cache/czkawka),再扫同一个目录时只处理新增和变化的文件。这也是"每周扫一次"成本很低的原因。
删除前走回收站,给自己留后悔的窗口每组至少保留一份;用"移到回收站"而不是永久删除。清空回收站之前你有完整窗口期反悔,确认第一批删得没问题,再批量处理后面的组。
误删、漏扫、报错时这样补救
🗑️ 误删的文件去回收站找回,重要数据清理前先拷一份走回收站删除的文件都能找回;只有选了永久删除,Czkawka 自身不提供恢复。照片、合同这类重要数据建议清理前单独拷一份到移动硬盘,10 分钟换一份保险。
结果不对:一次只调一个参数定位原因相似图片混进不相干的图,就调高相似度阈值;明显相同的文件漏掉了,就检查是不是勾了"忽略相似文件名"或过滤掉了小文件;结果里全是无关紧要的小文件,就把最小体积从默认值调到 5MB。一次只动一个参数,方便判断是哪个起了作用。
视频工具报错先装 ffmpeg,再重启程序Linux 执行sudo apt install ffmpeg,macOS 用brew install ffmpeg,Windows 用choco install ffmpeg,装完重开程序再试。其他扫描任务不依赖它,不受影响。
下一步:今晚扫一次下载文件夹,算出能省几 GB
打开 Krokiet,只选"下载"文件夹,最小体积设 5MB,跑一次重复文件扫描,看着结果列表数一数能省出多少 GB——这个数字就是开头说的"几 GB 到几十 GB"落到你自己机器上的版本,也是后面坚持每周扫描的动力。想继续调参数,可以翻 官方使用说明 对照逐项看。
【免费下载链接】czkawkaMulti functional app to find duplicates, empty folders, similar images etc.项目地址: https://gitcode.com/GitHub_Trending/cz/czkawka
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考