研究论文
多栏排版、插图和引用。
查看原始来源 · arXiv也可以直接选择文件。浏览器先分析页面,转换时会把 PDF 发送给 Cloudflare。
载入 PDF 后,Markdown 会显示在这里。
这款在线 PDF 转 Markdown 转换器先用 PDF.js 在本机检查文本层、页面和来源坐标;付费云端转换再把文本 PDF 上传到 Cloudflare 的文档转换服务,生成可复制、下载和导出的 Markdown。
普通转换器往往只给出看似正确的文本;这里会为每个区块保留处理方法与 Markdown 偏移。Cloudflare 返回页标记时保留页码,Moondream 返回置信度时也会保留;坐标与置信度只有来源确实提供时才显示,不会伪造。
普通数字 PDF——论文、手册、合同、Word 或 LaTeX 导出的文件——走 Cloudflare 文本转换路径。纯扫描 PDF 会先在浏览器渲染成逐页图像,再发送给 Moondream 3.1 OCR。Word .docx 转换仍然全程本地完成。
每张卡片都会通过与用户文件完全相同的分流与转换流程加载真实 PDF。
多栏排版、插图和引用。
查看原始来源 · arXiv审计报表、密集表格和脚注。
查看原始来源 · SEC EDGAR中文标题、编号章节和混合标点。
查看原始来源 · MOST China浏览器最多先检查前 30 页来选择路径:文本 PDF 交给 Cloudflare 转换,纯图像 PDF 交给 Moondream 3.1 OCR。
在浏览器检测文本层、阅读顺序和扫描页。
文本 PDF 发送给 Cloudflare;纯扫描 PDF 渲染后发送给 Moondream OCR。
点击 Markdown 区块;服务有返回页码时显示对应页,否则明确标为整份文档。
云端 PDF 转换与 OCR 使用页面点数;浏览器本地 Word 转换继续公开且为 0 点。 查看页面点数和 Pro 价格
PDF 转 Markdown 转换完成后,可导出干净 Markdown,或选择保留工作流元数据的输出配置。
每篇 PDF 转 Markdown 转换器教程都包含可下载样例、预期输出、失败模式和修复方式,不生产泛泛的关键词文章。
关于转换流程、隐私、质量与限制的常见疑问。
先用 Google 登录,再在页面顶部选择 PDF 或打开内置示例。浏览器先分析页面:文本 PDF 发送给 Cloudflare 转成 Markdown,扫描 PDF 渲染成页面图像后发送给 Moondream 3.1 OCR。结果与原页并排,可复制或导出。
浏览器本地的 Word 转换免费。云端 PDF、扫描件 OCR 和图片识别需要先登录,并拥有可用点数或有效 Pro 订阅。结果不会自动保存,请在离开前复制或下载。
PDF 转换会上传。页面分析和预览在浏览器完成;文本 PDF 随后上传给 Cloudflare 文档转换服务,扫描 PDF 则本地渲染成逐页图像后发送给 Moondream 3.1 OCR。Word .docx 仍然只在本机转换。
可以。扫描件没有可用文本层,pdfmd 会在浏览器把它渲染成逐页图像,再发送给 Moondream 3.1 OCR,而不是返回空 Markdown。单张照片则走 Markdown 相机的云端识别流程。
简单表格可能转换成 GFM 表格。合并单元格、多行表头、公式和跨页表格仍可能被压平或误读,重要内容应对照原 PDF 核验。来源映射只保留转换服务实际返回的页标记、偏移等信息,不会自动诊断合并单元格。
粘贴进 Obsidian、Notion 或任意 Markdown 编辑器,提交到 MkDocs、Docusaurus 之类的文档站,或者分块用于检索增强生成。Obsidian 导出还会附带 frontmatter、目录和回到原页的锚点。