比较 PDF

比较 PDF

看清一份文档的两个版本之间到底改了什么,精确到词。

在浏览器里免费比较两个 PDF。页面会先被两两配对,所以在合同里插进一页,显示的是新增了一页,而不是把后面每一页都染成红色。然后逐词比对,把真正改动的那几段在两份文件上并排框出来。你可以下载带高亮标记的新版本。没有任何上传:一份合同的两个版本,恰恰是最不该发给服务器的一对。

什么时候值得做

  • 合同从对方那边回来了,你要找出他们动过的那一条
  • 把供应商修改后的报价和当初谈定的那份核对一遍
  • 确认签署版和你发出去的版本一致
  • 找出编辑在你写的文档里改了什么
  • 判断一份报告的两个版本哪个更新
  • 证明一份文档自你上次看过之后没有被改动

你会得到什么

  • 先配对页面 - 插入或删除的一页就读作那一页,不会连累后面每一页。仅仅换了位置的页面会报成移动
  • 精确到词 - 真正改动的那几段在两份文件上被框出来,而不是它们所在的整个段落,你是看见改动,而不是去找改动
  • 它承认自己比不了什么 - 扫描页里没有文字。工具会直说,而不是报告没有差异,那是一个比较工具绝不能给出的唯一错误答案
  • 两个文件都不离开你的设备 - 一份合同的两个版本,恰恰是最不该上传的一对。这一切都在你的浏览器里进行

隐私优先:

两个 PDF 都在你的浏览器内被读取和比较。没有上传,没有服务器,任何地方都不留副本。关掉标签页,什么都不会剩下。

关于比较 PDF 的问题

如果有一页被插入或删除了会怎样
会被报成新增或删除了一页,它前后的页面则保持原样。这正是在比较任何内容之前先把页面配对起来的全部理由:一个把第 2 页配第 2 页的工具,会把一次插入变成一份此后全都像是被重写的文档,而你真正要找的那处改动淹没在噪音里。
能比较扫描件吗
没法有用地比较,而且它会直说,不会假装。扫描件是文字的照片,里面没有可比较的文字,所以那些页面会被单独计数并报告为未比较。先用 OCR 工具给它们加上文字层,再比较结果。
它会注意到排版变化吗
不会。这里比较的是文档说了什么,而不是它长什么样,所以一个往下挪了位置、或者换了字体的段落会读作未改动。这是刻意的:对合同和报告来说,词才是本体,一个因为页边距动了就亮起来的比较,谁也用不了。
下载的文件里有什么
就是你的修订版 PDF,原样保留,只是在每一处改动上画了高亮。它是一个普通的 PDF,你可以直接发给需要审批改动的人,对方不需要这个工具也能看见。
能处理多大的文档
一份 300 页的文档读取加配对,用时远不到一秒。页面只有在你去看的时候才会绘制,所以文件多大并不决定你要等多久。一整页从头改到尾的,会报成整页改动而不是逐词标注,这样一个病态的页面就不会把标签页卡死。
我的文件会被上传吗
不会。两个文件都在你的浏览器内读取、配对和比较,带标记的副本也是在那里写出来的。什么都不会发往任何地方,而这一点在这里比本站几乎任何其他地方都更重要:如果你在比较一份协议的两个版本,那是两份你有充分理由不交给服务器的文档。
💡

弄清什么挪动了之后,用整理 PDF 把页面放回原位,或者用涂黑去掉一段。

您可能还需要: