PDF Commons

去除 PDF 元数据

去掉文档信息字典和目录元数据流。页面内容留下。 它在这个标签页里运行。文件不会上传。

$6 的日票是 24 小时,只收一次,并且不续费。 价格

这个选择不会加载广告脚本。选择留在这台浏览器里。

这次去除改了什么

去除 PDF 元数据接收一份 PDF,并下载 without-metadata.pdf。电脑上的原文件不会被改写。结果仍是一份 PDF,不是 zip。文档信息字典存在时,worker 删除 Title、Author、Subject、Keywords、Creator、Producer、CreationDate 和 ModDate。目录的 Metadata 项存在时,worker 删除该项和目录元数据流。页面内容留下。可见文字留下。画好的矩形留下。这个页面不编辑内容流,也不画任何东西。它不删除字体名称,也不删除图片里的图像 XMP。重新打开的文档没有标题,也没有作者。这些值是没有,不是空字符串。这个页面不设置密码,也不去掉密码。

去除在这个标签页里用开源 workers 运行。文件不会上传。没有 GridFS 副本。打开网络面板,放下文件,PDF 不应该作为上传出现。关闭标签页就丢掉这份副本。表单不问邮箱。/pdf-to-word 的 PDF 转 Word 会上传。OCR 是 /ocr-pdf。重度压缩是 /compress-pdf-heavy。解锁是 /unlock-pdf,保护是 /protect-pdf。

没有公布的页数上限。标签页必须装得下文件。这个页面没有账户。日通行是 $6,只收一次,24 小时,并且不续费。年是 $60,共 365 天。$6 日通行和 $60 年是给服务器作业的。这个页面不需要它们。免费的服务器文件是一次 PDF 转 Word,最多 20 页。那个 20 页的服务器上限不是这个工具。OCR 不是免费的。重度压缩也不是免费的。

空文件,以及打不开的文件,失败时显示 "This PDF could not be read." 没有页面的 PDF 失败时显示 "This PDF has no pages." 锁定的 PDF 失败时显示 "Input document to `PDFDocument.load` is encrypted. You can use `PDFDocument.load(..., { ignoreEncryption: true })` if you wish to load the document anyways." 这个页面不猜测密码。解锁 PDF 是另一个页面。

步骤

  1. 放入文件。它留在这个标签页。
  2. 如果这一页有一个选项,就设置它。
  3. 下载结果。关闭标签页会丢掉这份副本。

问题

这次去除清掉什么?

信息字典存在时的八个信息键:Title、Author、Subject、Keywords、Creator、Producer、CreationDate 和 ModDate。它也去掉目录的 Metadata 项和目录元数据流。页面内容、可见文字和字体名称留下。图片里的图像 XMP 不会去掉。下载文件是 without-metadata.pdf。重新打开的文件没有标题和作者,那些值是没有,不是空字符串。

去除 PDF 元数据会上传文件吗?

不会。它在这个标签页里运行。文件不会上传。没有 GridFS 副本。关闭标签页就丢掉这份副本。下载文件是 without-metadata.pdf。/pdf-to-word 的 PDF 转 Word 才是上传的页面。

页面内容会留下吗?

会。页面内容留下,包括可见的词和画在页面上的矩形。这个工具不编辑内容流。去掉的只有文档信息字典和目录元数据流。字体名称和图像 XMP 不会被清掉。

需要日通行或年吗?

不需要。日通行是 $6,只收一次,24 小时,并且不续费。年是 $60,共 365 天。这些价格是给服务器作业的。这个页面不需要它们。20 页的服务器上限不是这个工具。这里没有账户。

还可以