批量文件MD5校验哈希值校验工具
加入文件
把一批文件或整个文件夹拖到这里
格式不限,子目录会自动展开收集
文件只在本机内存里被读取,不会上传到任何服务器;关闭页面后队列与结果一并清除。
计算与输出
顺带算 SHA-256(慢一些)
同名同体积的文件不重复入队
加入文件后立即开算
校验清单(可留空)
带文件名的行按名字精确配对;只写哈希时当作一个集合,算出的值命中即视为通过。以 # 开头的行会被忽略。
批量结果与逐项比对
0%
MD5 适合发现下载中断、磁盘坏块这类无意损坏;若要防范刻意伪造,请勾选 SHA-256 一起核对。本工具结果仅供参考,不构成任何安全结论或建议。
什么时候需要成批地核对 MD5
一个文件对一次哈希不算麻烦,麻烦的是几十个:一整套离线安装包、一个季度的数据库备份、交付给客户的整个资源目录,逐个拖进单文件工具再手动誊抄哈希,眼睛很容易花,也很容易漏掉其中一个。
这个页面把这件事变成一次操作:文件成批丢进来,或者干脆把文件夹整个拖进来,队列会自动排好,一个接一个读完并给出 32 位 MD5。如果对方还提供了校验清单,把清单整段粘到左下角,页面会按文件名替你一行行配对,哪个一致、哪个对不上、哪个清单里压根没有,直接在表格里标出来。
读取走的是 2MB 分片,单个文件再大也不会把内存吃满;所有运算由本机 CPU 完成,文件不产生任何上传行为。
这个页面把这件事变成一次操作:文件成批丢进来,或者干脆把文件夹整个拖进来,队列会自动排好,一个接一个读完并给出 32 位 MD5。如果对方还提供了校验清单,把清单整段粘到左下角,页面会按文件名替你一行行配对,哪个一致、哪个对不上、哪个清单里压根没有,直接在表格里标出来。
读取走的是 2MB 分片,单个文件再大也不会把内存吃满;所有运算由本机 CPU 完成,文件不产生任何上传行为。
四步用完
第一步 · 把文件塞进队列
拖动多选的文件到虚线框,或者点「选择文件夹」把整个目录交给它,子目录里的文件会被一并收集,文件名前会保留相对路径,方便区分不同目录下的同名文件。
第二步 · 定一下输出习惯
哈希默认输出小写,需要跟大写清单比对时切一下即可,切换后表格实时改写。要更强的摘要就勾上 SHA-256,表格会多出一列。默认加入文件后立刻开算,想先攒够一批再算就取消这个勾选。
第三步 · 粘贴清单让它自己比
把发布方给的校验清单整段粘进左下角文本框,md5sum 输出、文件名在前的写法、只有哈希的裸清单都认。清单一改动,比对结果会立即重算,不需要重新读文件。
第四步 · 结果带走
「复制结果」提供三种排版:纯哈希、md5sum 风格、以及可直接粘进表格的制表符格式;需要归档就点「导出 Excel」,序号、文件名、体积、字节数、哈希与比对结论都在里面。
拖动多选的文件到虚线框,或者点「选择文件夹」把整个目录交给它,子目录里的文件会被一并收集,文件名前会保留相对路径,方便区分不同目录下的同名文件。
第二步 · 定一下输出习惯
哈希默认输出小写,需要跟大写清单比对时切一下即可,切换后表格实时改写。要更强的摘要就勾上 SHA-256,表格会多出一列。默认加入文件后立刻开算,想先攒够一批再算就取消这个勾选。
第三步 · 粘贴清单让它自己比
把发布方给的校验清单整段粘进左下角文本框,md5sum 输出、文件名在前的写法、只有哈希的裸清单都认。清单一改动,比对结果会立即重算,不需要重新读文件。
第四步 · 结果带走
「复制结果」提供三种排版:纯哈希、md5sum 风格、以及可直接粘进表格的制表符格式;需要归档就点「导出 Excel」,序号、文件名、体积、字节数、哈希与比对结论都在里面。
常见的几种用法
整套安装包验收:离线部署包往往是一堆 rpm、jar、zip,供应商随包给一份 md5 清单,粘进来一次就知道有没有缺斤少两。
搬完大批文件后自查:硬盘对拷、网盘上下、机房之间同步之后,两端各跑一遍,把两份结果放一起比,比肉眼看文件大小可靠得多。
批量找重复文件:把疑似重复的目录整个拖进来,按哈希列排序,值相同的就是同一份内容,改过名、换过后缀都躲不掉。
备份定期巡检:给归档目录留一份哈希清单存档,下个季度再算一次贴进清单框,能提前发现磁盘静默损坏。
交付留痕:给客户或测试同学发包时顺手导出 Excel 附在邮件里,日后出现文件对不上的争议,有据可查。
搬完大批文件后自查:硬盘对拷、网盘上下、机房之间同步之后,两端各跑一遍,把两份结果放一起比,比肉眼看文件大小可靠得多。
批量找重复文件:把疑似重复的目录整个拖进来,按哈希列排序,值相同的就是同一份内容,改过名、换过后缀都躲不掉。
备份定期巡检:给归档目录留一份哈希清单存档,下个季度再算一次贴进清单框,能提前发现磁盘静默损坏。
交付留痕:给客户或测试同学发包时顺手导出 Excel 附在邮件里,日后出现文件对不上的争议,有据可查。
常见问题
Q1. 一次最多能放多少个文件?
没有写死上限,队列按加入顺序串行处理,几百个中小文件都能跑完,总耗时约等于每个文件耗时相加。若队列里混着几个几 GB 的大件,建议拆成两三批,方便中途查看已完成的部分。
Q2. 校验清单具体支持哪些写法?
三种。一是 md5sum / certutil 常见的「哈希 + 空格 + 文件名」,文件名前带星号也认;二是「文件名 + 空格或制表符 + 哈希」;三是只有一列 32 位哈希。前两种按文件名配对,第三种按集合命中,适合文件被改过名的情况。以 # 开头的行视为注释。
Q3. 比对列显示「未找到」是出错了吗?
不是出错,意思是清单里没有与该文件名对应的记录。常见原因是清单不完整,或本地文件被重命名过。可以把清单改成只保留哈希的写法再比一次,这时只要哈希命中集合就算通过。
Q4. 文件夹拖进来,子目录会漏吗?
不会。工具沿目录树递归收集各级文件,目录本身不参与计算,系统生成的 .DS_Store、Thumbs.db 会自动跳过。文件很多时前几秒可能只在收集列表,稍等就能看到进度条开始推进。
Q5. 这些文件会被上传吗?
不会。页面只用浏览器自带的 File 与 FileReader 接口在本地读取内容,哈希由本机 CPU 算出,整个过程没有网络请求,也不写服务器日志。文件名、哈希以及粘贴的清单只存在于当前标签页,关掉即消失。
Q6. 为什么有的行 SHA-256 显示已跳过?
SHA-256 走浏览器原生 crypto.subtle 接口,需要把整个文件读进内存,因此单个文件超过 300MB 会自动跳过该列,MD5 仍照常计算。想给大文件补 SHA-256,可改用命令行工具,或先切分文件。
Q7. 同一批文件换台电脑算,结果会变吗?
不会。MD5 只由文件的字节内容决定,与文件名、存放路径、修改时间、操作系统都无关。只要内容一个字节没动,任何工具算出来的都是同一串值,这也是它能用来判断内容是否相同的原因。
