PDF比较

PDF只会在本浏览器中读取。分步流程中的文件会在30分钟后失效,并在页面保持打开时或下次打开工具时删除。文件不会写入页面地址,也不会发送到服务器。

无需上传文档,即可比较两个PDF版本中可提取的文本。本工具使用PDF.js读取每一页,规范化空白,并高亮只出现在旧版或修订版中的文字。

如何比较两个PDF

  1. 1

    选择旧版文件

    选择PDF A,文件不超过25 MB、200页。

  2. 2

    选择修订版

    选择PDF B。使用分步流程时,两个文件会在浏览器私密存储中保留最多30分钟。

  3. 3

    查看变更页面

    浏览器逐页提取文本,以红色标出删除内容,以蓝色标出新增内容。

能检测哪些差异

结果会比较PDF.js从相同页码中提取的文本,适合检查合同、报告、校样和草稿中的文字修改。比较前会规范化空白,因此单纯的换行变化通常不会产生大量干扰。

不会比较哪些内容

这不是视觉或语义比较。字体、版式、图像、批注、表单值、元数据和数字签名有效性均不在比较范围内。如果扫描版PDF没有现成的OCR文本层,可能无法提取文字。如果一个版本增加了封面,后续页码也会错位。

隐私与限制

文件和提取文本只留在浏览器中,不会发送到我们的服务器。分步流程中的文件会在30分钟后失效,并在页面保持打开时或下次打开工具时删除。每个文件上限为25 MB、200页和2,000,000个提取字符。

常见问题

仅当扫描件已经包含OCR文本层时可以。本工具本身不执行OCR。

不是。这只表示规范化空白后的可提取文本一致,视觉元素和PDF内部结构仍可能不同。

不会。PDF.js在本地读取文件,分步流程使用浏览器私密存储,而非服务器存储。

PDF保存的是带位置的绘制指令,而不是段落。复杂分栏、表格和表单可能以意外顺序被提取。

相关工具