请问: Linux 系统下,有没有好用的 [查找重复文件] 的软件?

c2r5 2026-07-21 13:37 1

在 Windows 中,查找重复文件,一直以来,我使用的,是一款名为 [ NoClone ] 的软件。它是以二进制对比的方式,查找出 [文件内容] 完全一样的文件,哪怕你把其中的一个文件的 [文件名] 和 [扩展名] 全都更改了, [ NoClone ] 这个软件,也能把它识别出来。当然, [ NoClone ] 识别识别出来的重复文件,它们的哈希值,实际上,也是一样的。


最近,我开始接触 Ubuntu ,我想请问一下,在 Linux 中,特别是在 Ubuntu 中,没有类似于 NoClone 这样的软件?


请了解这方面的大佬,推荐几个软件。


谢谢!

最新回复 (22)
  • xtreme1 07-21 13:41
    1
    严肃场景一般在 fs 层面解决
    闹着玩你随便找个或者手搓个就行了
  • jjianwen68 07-21 13:50
    2
    google gemini ,看看 fdupes 和 rdfind ,或者描述一下需求,让 AI 生产 shell 脚本
  • chengrui0428 07-21 13:58
    3
    我自己做了一个 https://github.com/Laotree/onley
  • chinafengzhao 07-21 14:03
    4
    什么叫重复文件,这个要明确一下,软链接,硬链接,这种算不算?
  • c2r5 楼主 07-21 14:09
    5
    @chengrui0428
    好的,谢谢!得空时,我试着用用看。
  • c2r5 楼主 07-21 14:17
    6
    @chinafengzhao
    比如,不同时间内,从网上下载的文件,其实,在本地硬盘内的,在不同的文件夹内,其实,已经有好几分了,虽然可能文件名不一样。
    再比如,自己工作产生的文件,由于自己管理混乱,时间久了,可能同一个文件,也会同时出现在几个不同的文件夹之内。
    我就是想要查找出来,那些在二进制上,完全相同的文件。
  • bgm004 07-21 14:17
    7
    你在找这样的? https://github.com/qarmin/czkawka
  • blankmiss 07-21 14:19
    8
    怎么听起来像是比对 hash
  • zwb9412 07-21 14:22
    9
    我想如果只是临时起意简单看看文件重复写个命令看看就能做到,
    find -type f |xargs md5sum |sort|uniq -w 32 -c -d
    缺点是不会打出全部重复路径,可以先输出一份 hash 记录,然后把重复的打出来在搜一次。
  • c2r5 楼主 07-21 14:23
    10
    @bgm004
    谢谢!我抽空看一下。现在,我先要去忙别的事情,有空闲时,再具体了解一下。
  • killva4624 07-21 14:28
    11
    linux 下让 AI 搓个脚本,md5sum 把文件跑一遍就能解决了。
    非要界面的话,用 python 或者 node 搓一个 gui 库也不是什么事...
  • zwb9412 07-21 14:32
    12
    @zwb9412
    不打印重复数量只输出重复文件改成-D
    find -type f |xargs md5sum |sort|uniq -w 32 -D
  • waahii 07-21 14:38
    13
    czkawka

    里面使用的 b3sum ,速度不错
    甚至也支持相似视频和图片的对比。

    在 Linux 和 Windows 下都用
  • rock123 07-21 15:09
    14
    https://github.com/pkolaczk/fclones
  • mephisto 07-21 15:13
    15
    https://codeberg.org/jbruchon/jdupes 你需要的可能是这个
    老实说个人用户,随便对比下 hash 值就 ok 了。除非你日常是个重复收藏控,有复杂的判定删除逻辑,写个程序就搞定了。这种明确需求,问下 AI ,一会就给出各种方案。
  • Rickkkkkkk 07-21 15:13
    16
    你把需求讲明白,让 codex 写一个吧。
  • xue777hua 07-21 15:14
    17
    显然楼上的方向搞错了… 校验 hash 成本太高了…
    纯基于 meta data 验证可信度就已经很好了 没有必要用 checksum
  • jark006 07-21 15:29
    18
    直接 vibe 一个啊,感觉不难,写出来也快。
    先遍历目标文件夹的全部文件的大小,把大小相同的记下来,再对这些大小相同的文件做前 N 字节对比或哈希,再相同就继续文件的下一段区间哈希对比,或者整个文件哈希对比。
    你问 AI 还能有更优的方案
  • noahliaszn 07-21 15:32
    19
    都用 Linux 了 一行命令都可以搞定了
  • unused 07-21 15:45
    20
    把所有文件按内容放入一个 B+ 树索引
  • fugu37 07-21 17:07
    21
    fclones https://github.com/pkolaczk/fclones#benchmarks

    README 中还有一系列同类软件
  • mashimaroinfo1 07-21 17:37
    22
    Czkawka
* 帖子来源V2EX
返回