PDF比较
PDF只会在本浏览器中读取。分步流程中的文件会在30分钟后失效,并在页面保持打开时或下次打开工具时删除。文件不会写入页面地址,也不会发送到服务器。
选择较早版本的PDF
无需上传文档,即可比较两个PDF版本中可提取的文本。本工具使用PDF.js读取每一页,规范化空白,并高亮只出现在旧版或修订版中的文字。
如何比较两个PDF
-
1
选择旧版文件
选择PDF A,文件不超过25 MB、200页。
-
2
选择修订版
选择PDF B。使用分步流程时,两个文件会在浏览器私密存储中保留最多30分钟。
-
3
查看变更页面
浏览器逐页提取文本,以红色标出删除内容,以蓝色标出新增内容。
能检测哪些差异
结果会比较PDF.js从相同页码中提取的文本,适合检查合同、报告、校样和草稿中的文字修改。比较前会规范化空白,因此单纯的换行变化通常不会产生大量干扰。
不会比较哪些内容
这不是视觉或语义比较。字体、版式、图像、批注、表单值、元数据和数字签名有效性均不在比较范围内。如果扫描版PDF没有现成的OCR文本层,可能无法提取文字。如果一个版本增加了封面,后续页码也会错位。
隐私与限制
文件和提取文本只留在浏览器中,不会发送到我们的服务器。分步流程中的文件会在30分钟后失效,并在页面保持打开时或下次打开工具时删除。每个文件上限为25 MB、200页和2,000,000个提取字符。
常见问题
仅当扫描件已经包含OCR文本层时可以。本工具本身不执行OCR。
不是。这只表示规范化空白后的可提取文本一致,视觉元素和PDF内部结构仍可能不同。
不会。PDF.js在本地读取文件,分步流程使用浏览器私密存储,而非服务器存储。
PDF保存的是带位置的绘制指令,而不是段落。复杂分栏、表格和表单可能以意外顺序被提取。
相关工具
拆分 PDF
将 PDF 拆分为每页一个文件,或按 1-3、4-6、8 这样的自定义范围拆分。在浏览器中处理并下载 ZIP。
PDF 转 JPG 转换器
按所需分辨率和质量将 PDF 页面转换为 JPG 图片。可下载单个页面,也可将全部页面打包为 ZIP。
从 PDF 中删除页面
从 PDF 中删除选定页面或页面范围。输入 2, 5-7 这样的页码,至少保留一页,然后下载精简后的 PDF。
PDF 转 Word
将 PDF 转换为可完整编辑的 Word 文档。保留标题、列表、图片和表格。扫描版 PDF 会自动经过 OCR 处理。
PDF 转 Excel 转换器
检测文本型 PDF 中的规则表格,在本地下载 XLSX、CSV 或 TSV。导出前可逐表检查。上限为 20 MiB 和 150 页。
压缩 PDF
在浏览器中压缩 PDF,将页面重新渲染为基于 JPEG 的更小 PDF,便于分享和上传。