如何从 Adobe Acrobat 导出 XFDF 批注(注释):完整指南
要从 Adobe Acrobat 导出 XFDF 批注(也叫注释),请打开带批注的 PDF,转到 File → Export → Annotations,选择 XFDF (*.xfdf) 作为格式,然后将文件保存到您的电脑。生成的 .xfdf 文件是一个 XML 文档,包含您创建的每一个高亮、批注和标记,您可以把它导入 pdfannotations.com 转换为 Markdown、Obsidian、Notion、CSV、JSON 或纯文本——所有处理都在您的浏览器本地完成,无需上传。
本指南将完整介绍 Adobe Acrobat XFDF 导出工作流,解释 XFDF 文件实际包含的内容,并展示如何将这些导出的批注转化为干净、可复用的知识。无论您使用的是 Acrobat Standard、Acrobat Pro 还是 Acrobat Reader,操作步骤都相同。
什么是 XFDF 文件?
XFDF(XML Forms Data Format)文件是 PDF 注释的 XML 表示形式。PDF 文件将注释作为二进制对象存储在文档内部,而 XFDF 将它们提取为一种可移植、可直接阅读的 XML 结构,任何兼容工具都可以解析。Adobe 推出 XFDF 作为旧版 FDF 格式的轻量替代方案;传统 FDF 通常使用难以手动检查和编辑的 PDF 对象语法。
典型的 XFDF 文件如下所示:
<?xml version="1.0" encoding="UTF-8"?>
<xfdf xmlns="http://ns.adobe.com/xfdf/" xml:space="preserve">
<f href="research-paper.pdf"/>
<ids original="abc123" modified="def456"/>
<annots>
<highlight page="0" color="#FFEB3B" date="D:20260720120000Z">
<contents>This is the key argument.</contents>
<Popup page="0" rect="100,200,300,250"/>
</highlight>
<text page="2" color="#4F46E5" date="D:20260720121000Z">
<contents>Review this section carefully.</contents>
</text>
</annots>
</xfdf>
每个 <highlight>、<text>、<underline> 或 <strikeout> 元素都携带页面编号、颜色、作者和创建日期等元数据,以及您在批注字段中写入的文本内容。由于 XFDF 是纯 XML,它体积小、易于版本控制,并且可以用任何 XML 库轻松解析。
要深入了解该格式本身,请参阅我们的 XFDF 文件格式说明。
为什么导出 XFDF 而不是直接在 PDF 中工作?
直接在 PDF 中处理注释看似方便,但对知识工作存在实际弊端:
- 锁定: 注释被困在源 PDF 中。跨 50 篇论文搜索意味着打开 50 个文件。
- 无法复用: 如果不经提取步骤,您无法将 PDF 内嵌的高亮导入 Obsidian、Notion、向量数据库或 LLM。
- 版本膨胀: 对大型 PDF 内注释的反复编辑会使文件膨胀,并可能随时间损坏文档。
- 工具碎片化: 不同的 PDF 阅读器以微妙不兼容的方式存储注释;XFDF 是 Adobe 保证能正确往返的唯一中立交换格式。
导出 XFDF 将您的注释与源文件解耦,为您提供一个可移植的独立数据文件,可转换为下游工作流所需的任何输出。
第 1 步:在 Adobe Acrobat 中创建注释
导出之前,您需要有可导出的注释。在 Adobe Acrobat 中打开您的 PDF,使用 Comment 工具(在 Acrobat Standard、Pro 和免费的 Acrobat Reader 中均可用)对文档进行标记。
建议使用的注释类型:
- Highlight — 用于关键段落和可引用文本
- Text Comment (Sticky Note) — 用于您自己的反应和笔记
- Underline / Squiggly — 用于定义、术语或需要核实的内容
- Strikeout — 用于计划删除或不再相关的章节
- Free Text — 用于应随文档一起传递的内联批注
专业提示 — 颜色编码: 在开始之前选择一致的配色方案。例如,黄色用于关键概念,绿色用于可操作要点,红色用于不同意见,蓝色用于定义。pdfannotations.com 在导出时会保留这些颜色,因此您稍后可以在 Obsidian 或 Notion 中按颜色筛选和分组。
第 2 步:导出 XFDF 文件
注释就位后,导出 XFDF 大约只需 10 秒钟:
- 在 Acrobat 中打开 PDF,转到 File → Export(在某些版本中是 File → Export To)。
- 从导出选项中选择 Annotations。
- 在格式下拉菜单中,选择 XFDF (*.xfdf)。
- 选择目标文件夹并点击 Save。
现在您的 PDF 旁就有了一个 .xfdf 文件。它通常只有几 KB——远小于 PDF 本身——因为它只包含注释元数据和文本,不包含页面内容。
替代方案:使用 Comments List 导出
如果您的 Acrobat 版本不显示 File → Export → Annotations 路径,您也可以从 Comments 面板导出:
- 打开右侧的 Comments 面板。
- 点击选项菜单(面板顶部的三个点或汉堡图标)。
- 选择 Export All To Data File… 或 Export Comments To XFDF。
- 保存文件。
结果与 File → Export 路径相同;两者都生成符合标准的 XFDF 文档。
Acrobat Reader 怎么办?
免费的 Adobe Acrobat Reader 在桌面端支持 XFDF 导出。菜单位置可能因版本略有不同,但 Comments → Export 选项始终可用。如果您只安装了 Reader,仍然可以在没有付费订阅的情况下完整跟随本指南。
第 3 步:将 XFDF 导入 pdfannotations.com
前往我们的 XFDF 转 Markdown,将您的 .xfdf 文件拖入拖放区。该工具完全在您的浏览器中运行——您的文件从不会上传到服务器,这对于机密研究论文、法律合同和公司内部文档非常重要。
如果您正在处理一批论文,也可以一次拖入多个 XFDF 文件,或在同一会话中将 XFDF、PDF 和 XML FDF 文件混合使用。解析器会将它们合并为一个统一的注释工作区;传统二进制 FDF 需要先在 Acrobat 中重新导出。
文件加载后,您将看到一个三面板工作区:
- 左侧: 每个注释的可排序列表,按页面或类型分组
- 中间: 所选注释在上下文中呈现
- 右侧: 元数据面板(作者、颜色、日期、页面编号、标签)
您可以在导出之前对注释进行排序、分组、筛选、标记和去重,当同一段落被不同审阅者多次高亮时,这尤其有用。
第 4 步:导出为 Markdown 或 Obsidian
加载注释后,点击顶部工具栏的 Export 按钮。您将看到一个输出格式列表:
| 格式 | 最适用于 |
|---|---|
| Markdown | 通用笔记应用(Bear、Logseq、标准 Markdown 编辑器) |
| Obsidian | Obsidian 仓库——支持 Callouts、Frontmatter 和 Page References |
| Notion | 带结构化属性的 Notion 数据库 |
| CSV | 电子表格分析和数据透视表 |
| JSON | 编程管道和自定义工具 |
| Text | 快速粘贴到电子邮件或聊天中 |
| Excel | 审阅者使用电子表格的共享审阅环境 |
| ZIP | 一次性打包所有格式 |
| AI Context | 专门用于粘贴到 ChatGPT、Claude 或 Gemini 的 Markdown |
| RAG JSON | 用于检索增强生成,可直接写入向量数据库 |
对于最常见的用例——将注释导入笔记工具——选择 Obsidian 并启用三个可选功能:
- Callouts — 将每个高亮包裹在
> [!quote]语法中,使 Obsidian 将其渲染为样式化的引用块 - Frontmatter — 在顶部添加 YAML 块,包含来源、页数、作者和标签
- Page References — 将页码转换为
[[file#Page N]]链接,使高亮成为可导航的双向链接
点击 Export,一两秒内一个 Markdown 文件就会下载到您的电脑。要深入了解该下游工作流,请参阅我们的 XFDF 到 Obsidian 工作流指南。
第 5 步:导入导出的文件
最后一步取决于您的目标工具:
- Obsidian — 将
.md文件直接保存到您的仓库文件夹(例如Literature Notes/),然后打开 Obsidian。笔记会立即出现,完全链接和标记。 - Notion — 打开目标数据库,点击 Import → Markdown,然后上传文件。每个注释成为一行具有结构化属性的记录。
- 通用 Markdown 编辑器 — 在任何支持 Markdown 的编辑器中打开文件。
- 向量数据库 / RAG 管道 — 将 RAG JSON 导出文件提供给您的嵌入管道。请参阅我们的 PDF 批注(注释)转 AI 与 RAG 指南了解完整管道。
如果您需要我们上面未列出的格式,通用 PDF 注释导出工具也接受原始 PDF、XFDF 和 XML FDF,因此您可以在同一会话中混合搭配来源;传统二进制 FDF 需要先重新导出。
常见陷阱与修复
XFDF 文件为空
这通常意味着您导出的 PDF 包含 Acrobat 不会序列化为标准注释的标记——例如通过 Edit 工具而非 Comment 工具添加的手绘铅笔图形或形状。使用 Comment 面板的 Highlight 工具重新创建高亮,然后重新导出。
注释缺少作者或日期元数据
Acrobat 仅在通过 Comment 工作流创建注释且文档的身份首选项已设置时才写入作者和日期。如果您从其他阅读器(例如 Foxit、PDF-XChange)导入注释,某些字段可能为空。pdfannotations.com 工作区允许您在导出之前填写缺失的元数据。
导出的 Markdown 有重复高亮
当同一段落被多次高亮,或同一 XFDF 在一个会话中被上传两次时,会出现重复。在导出之前使用工作区工具栏中的 Deduplicate 开关——它将同一页面上的相同高亮合并为单个条目。
导出后颜色丢失
如果颜色在输出中显示为 #000000,则源 PDF 使用了非标准颜色空间。Acrobat 的 XFDF 导出将颜色写为 RGB 十六进制值,因此只要您使用标准 Highlight 工具进行注释,颜色应该能正确往返。如果发现颜色数据丢失,请从 Acrobat 重新导出。
高质量 XFDF 导出技巧
- 有目的地注释: 将每个高亮视为未来的原子笔记。如果一段内容不值得作为独立笔记,就不要高亮它。
- 为每个高亮写批注: 带有批注的高亮在下游知识库中比单纯的高亮有用得多。即使只有一个词("同意"、"验证"、"引用"),也能显著改善检索。
- 在批注中使用页码: Acrobat 会自动记录页码,但在批注文本中添加页码可使纯文本导出更易于 grep。
- 避免在导出之间使用其他阅读器编辑注释: 每次通过不同阅读器往返都可能微妙地重写 XFDF 结构。在整个文档生命周期中选择一个工具并坚持使用。
- 版本化您的 XFDF 文件: 由于 XFDF 是纯 XML,它在 git 中可以清晰地对比变更。如果您正在进行长期研究,请将
.xfdf文件与 PDF 一起保存在版本化文件夹中。
为什么本地优先的 XFDF 工作流很重要
大多数在线"PDF 注释提取"服务将您的文件上传到服务器,进行处理,然后返回结果。这对任何处理以下内容的人来说都是问题:
- 受 IRB 或 NDA 约束的机密研究
- 受律师-客户特权保护的法律合同
- 受数据驻留要求约束的公司内部文档
- 尚未共享的预发表学术工作
本地优先工作流——Acrobat 在您的机器上导出 XFDF,pdfannotations.com 在您的浏览器中解析它,Markdown 文件保存在您本地的 Obsidian 仓库中——使每个字节都留在您控制的硬件上。没有服务器会看到文件,这意味着没有泄露面、没有数据驻留问题,也没有埋在服务条款中的"我们使用您的文档训练了我们的模型"的意外条款。
常见问题
我可以从 Acrobat Reader 免费导出 XFDF 吗?
可以。免费的 Adobe Acrobat Reader 通过 Comments 面板支持 XFDF 导出。您不需要付费的 Acrobat Standard 或 Pro 订阅。
XFDF 和 FDF 之间有什么区别?
XFDF 是基于 XML 的 FDF 继任者。两种格式携带相同的注释数据,但 XFDF 是可直接阅读的,更易于在版本控制中 diff,并受到更广泛的现代工具支持。如需完整比较,请参阅我们的 XFDF 格式指南。
我可以一次从多个 PDF 批量导出 XFDF 吗?
Acrobat 每个 PDF 导出一个 XFDF,但您可以在一个会话中将多个 XFDF 文件拖入 pdfannotations.com 工作区,并将它们合并为一个导出。
pdfannotations.com 的 XFDF 转换工具真的是本地的吗?
是的。XFDF 解析器完全使用 JavaScript 在您的浏览器中运行。您的文件从不上传到服务器。您可以通过在页面加载后断开互联网连接来验证这一点——转换仍然有效。
相关指南
想了解更多?请查看这些相关指南:
- 什么是 XFDF?PDF 注释 XML 格式详解 - 深入了解 XFDF 文件格式、其 XML 结构,以及它与 FDF 和 PDF 注释的比较
- XFDF 到 Obsidian:将 Adobe PDF 注释转换为 Markdown - 将 XFDF 导出转换为带链接、标记的 Obsidian 笔记,支持 Callouts 和 Frontmatter
- PDF 注释到 AI 和 RAG - 将 XFDF 导出的注释导入 ChatGPT、Claude、Gemini 或向量数据库
- 将 PDF 高亮导出到 Obsidian:完整工作流指南 - 适用于任何 PDF 来源(不仅是 XFDF)的完整 Obsidian 工作流
- PDF 到 Markdown 最佳实践 - 适用于 Obsidian、Notion 等的干净转换模式