PDF 转 Markdown
从带文本层的 PDF 中提取可选中文本,按页面生成 Markdown,适合整理、迁移、笔记和发布。
工具说明
PDF 转 Markdown 工具会从 PDF 中提取可选中文本,并按页面生成 Markdown 初稿。它适合处理文字型报告、手册、笔记、导出文档和需要重新编辑的研究资料。
PDF 并不像普通文档那样保存内容结构,所以输出质量取决于原文件。扫描图片 PDF 需要先做 OCR,分栏页面和复杂表格通常还需要在生成 Markdown 后人工清理。
输入与输出示例
输入
一个名为 onboarding-guide.pdf 的文字型 PDF,第 1 页和第 2 页包含可选中文本。输出
# onboarding-guide
## Page 1
欢迎阅读入门指南。本节说明设置检查清单。
## Page 2
下一步包括账号权限、文档链接和审阅备注。如何使用这个转换工具
- 1上传包含可选中文本的 PDF 文件。
- 2工具会逐页提取文本,并添加 Markdown 页面标题。
- 3复制或下载结果,再清理标题、换行和表格细节用于发布。
适合哪些场景
- 把文字型报告、手册、论文笔记迁移到 Markdown。
- 先从 PDF 生成可编辑草稿,再做总结、改写或归档。
- 保留页码线索,方便整理到文档站或知识库。
常见问题
支持扫描版 PDF OCR 吗?
不支持。扫描图片 PDF 需要先做 OCR。这个工具只提取 PDF 内已经存在的文本层。
为什么有些换行需要手动清理?
PDF 的文本顺序取决于原文件生成方式。输出适合作为初稿,复杂表格和分栏内容可能需要人工整理。