☰
3步跑通Czkawka视频查重,1TB电影库腾出几十GB
2026/9/29 23:38:17 网站建设 项目流程

3步跑通Czkawka视频查重,1TB电影库腾出几十GB

【免费下载链接】czkawkaMulti functional app to find duplicates, empty folders, similar images etc.项目地址: https://gitcode.com/GitHub_Trending/cz/czkawka

硬盘又红了?清了三个月,一查重又挖出40G重复视频——不同分辨率、不同封装,内容却一模一样。Czkawka就是干这活的:免费开源、Rust写的,靠逐帧视觉比对做视频查重,跨平台,还能顺手清重复文件、空目录、坏链。

三步跑起来

1. 拿包:去官方发布页下载Windows版压缩包(注意选Krokiet,新一代Slint前端;老GTK版Czkawka停在12.0不再更新)。

2. 解压即用:丢进任意目录,绿色便携,不污染系统。

3. 双击启动:首次选语言即可,参数随时能调。想自动化?CLI版一行命令:git clone https://gitcode.com/GitHub_Trending/cz/czkawka && cargo build --release。

它凭什么认出重复视频

大白话原理:它不逐字节比文件(容器一改就失效),而是按间隔抽帧,把每帧转成"视觉指纹"——感知哈希。换个分辨率、重压一遍,指纹依然相近。所以"同一部片的两个版本"照样能对上。

参数别背,按场景选:

  • 带黑边的片被误判成另一部 → 打开Crop Detect,自动裁掉黑边再算指纹
  • 想快一点,宁可漏几个 → 调大Skip Forward Amount(抽帧间隔,0-300,默认15)
  • 想抓得更准 → 调大Duration(2-60秒,默认10)
  • 容忍度Tolerance是总闸门:5只留"几乎同一部",8开始收录换源重压版,再往上噪音明显
  • 同尺寸文件先手动对过哈希 → 勾"排除相同大小"省时间

结构体长这样(similar_videos 源码):

pub struct SimilarVideosParameters { pub tolerance: i32, pub exclude_videos_with_same_size: bool, pub skip_forward_amount: u32, pub duration: u32, pub crop_detect: bool, pub window_count: u32, pub min_matching_windows: f64, }

拿1TB电影库试了一轮

以1TB本地电影库为例:

  • 容忍度5 + 默认参数:识别出38组相似视频,耗时约22分钟,预计释放41GB
  • 容忍度提到8:多揪出14组"换源重压"版,组数到52,释放57GB,但出现2组把不同季剪进一集的内容误判为一组,删之前得逐组点开比对缩略图

处理动作三选一:保留最大/最高码率那版,把同组其余删除或移动到备份盘;懒得动文件就重命名加_dup,再跑一次"重复文件"精确清理。

踩过的坑 & 进阶玩法

  • 首次扫描最慢,它会把指纹写进缓存,二次扫描同一批库速度能快好几倍
  • Q: 硬链接算重复吗?算。但删"重复"时其实删的是同一个inode,想删干净前先查链接数
  • Q: 硬扫不动?拆目录分批跑,比单任务卡死强
  • 组合拳:视频查重跑完,接着跑"重复文件"(按哈希)+ "大文件",三层筛完,空间账才干净

一句总结:视频查重这口硬菜,Czkawka免费就能吃饱。版本更新看 Changelog.md。

【免费下载链接】czkawkaMulti functional app to find duplicates, empty folders, similar images etc.项目地址: https://gitcode.com/GitHub_Trending/cz/czkawka

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询