删除 PDF 重复页
用感知哈希检测并删除重复/相似页面
页面操作
🔒 100% 本地运行 — 你的数据不会离开当前页面由 ToolsKit 编辑团队维护•最近更新:2026年9月5日•最近复核:2026年9月5日
⏳加载工具中…
工具说明
删除 PDF 重复页工具通过感知哈希(aHash 和 dHash)比对每一页,即使页面并非字节完全相同也能识别视觉重复。可处理常见情况:同一页扫描两遍、合并多份文件时混入相同封面、批量处理产生的副本。相似度阈值滑块可调节匹配严格程度,缩略图网格展示哪些页面被判定为某页的重复,导出前可确认。每组保留首次出现的页面,删除其余,原顺序保持不变。全部处理在浏览器本地完成,PDF 不会上传。
常见问题
如何检测重复页?
将每页渲染为缩略图并计算感知哈希(aHash 和 dHash)。哈希距离低于相似度阈值的页面会被判定为某页的重复。
只能找出完全相同的副本吗?
不是。感知哈希还能识别近似重复,例如同一页扫描两遍但略有偏移,或渲染略有差异但视觉一致的页面。
发现重复时保留哪一页?
按文档顺序保留首次出现的页面,后续重复页被标记删除。导出前可取消勾选任意页面。
相似度阈值有什么用?
设定两页被判为重复所需的接近程度。数值越低越严格(仅近似完全匹配),数值越高会把大致相似的页面也标记。
PDF 会上传吗?
不会。哈希计算、比对和导出全部在浏览器本地完成,文档不会离开你的设备。
大 PDF 怎么处理?
80 页以内可全量两两比对;为加速可采用每页前后窗口比对。可切换全量比对与窗口模式。
文字相同但版式不同的页会被删除吗?
不会。感知哈希基于视觉外观,文字相同但版式不同的页面通常不会被标记为重复。
继续浏览