一个 Word 文件或 PDF 会暴露你什么
文档说出的,远比写在上面的多。这在律师事务所、新闻编辑室和政府机关里是众所周知的问题。
一个 .docx 带着什么
Word 维护着一个会自动填写的属性区块:
- 谁创建、谁最后修改,用的是账户名称。
- 那台电脑上 Office 里设置的公司名。
- 总编辑时长和修订次数。
- 创建和最后修改的时间,精确到秒。
PDF 带着什么,以及常见的错误
PDF 把元数据放在两个地方:属性字典,和一个 XML 格式的 XMP 区块。许多工具只清空前者就认为完事了,XMP 里还留着作者、软件和日期的第二份副本。
这正是 KillEXIF 上一个版本存在的缺陷,也是这次重写的原因之一。
还有压缩包本身的时间
.docx、.xlsx 或 .odt 实际上是压缩包。里面的每一个部件都带着自己的时间戳,精确到两秒,即便属性是干净的,也足以还原你的工作时段。它们通常还带着你的系统用户名和文件权限。