对比两份 PDF

放入两份 PDF,逐行查看它们的文字内容对比结果,新增和删除的内容都会被高亮显示。

点击或拖放原始 PDF

点击或拖放修改后的 PDF

放入两份 PDF 即可查看对比结果。

工作原理

每份 PDF 都通过 pdf.js 读取——这正是 Firefox 用来渲染 PDF 的引擎——遍历每一页的内容 流,通过 getTextContent() 收集其中嵌入的文字。得到的两段文字随后会按行 拆分,并使用与 norito 的 文本对比 工具相同的最长公共 子序列(LCS)差异算法进行对比,找出能够解释两份文档差异的最小新增和删除集合,而不是 简单地按行号位置对比(那样的话,插入一个段落就会导致后面所有行都被标记为“已修改”)。

和所有 PDF 文字提取一样,结果取决于 PDF 中是否真的包含文字。扫描页面本质是图片, 没有内容可供对比。提取和对比这两个步骤都在这个浏览器标签页内完成,两份文件都不会被 上传。

常见问题

这个工具对比的是排版设计,还是只对比文字?

只对比文字内容。它会提取每份 PDF 中嵌入的文字并进行差异对比,因此能识别措辞变化、新增或删除的段落、被修改的数字,但无法识别纯视觉上的变化,比如字体替换,或者移动了图片但周围文字完全相同的情况。

这个工具能用于扫描版 PDF 吗?

不能。扫描页面本质上是图片,没有嵌入的文字,因此没有内容可供提取或对比,除非这份 PDF 已经经过 OCR 处理。

我的 PDF 会被上传到别的地方吗?

不会。两份文件都完全在你的浏览器中被读取和对比。不会上传任何内容,这对你正在对比的合同或草稿来说很重要。