为可核验结果而设计的 PDF 转 Markdown 转换器
pdfmd 把 PDF 变成可复用的 Markdown,同时保留转换过程的证据。产品优先采用浏览器本地提取,只有页面确实需要时才启用更重的处理。
- 默认保护隐私
- 数字 PDF 文本留在浏览器中。
- 用证据替代口号
- Markdown 区块保留页码和坐标信息。
- 只为困难页面付费
- OCR 升级按页提出并明确确认。
为什么要做这个产品
多数转换工具追求尽快提供下载,但论文阅读顺序错乱、合同脚注丢失或表格列错配,往往要到内容进入下游后才会被发现。
这款 PDF 转 Markdown 转换器把逐页来源信息放在输出旁边,让文档进入知识库、搜索、AI 或协作流程前就能完成核验。
本地优先,上传需同意
带文本层的 PDF 在浏览器内解析,文件留在设备上,不要求账户,界面也会明确显示上传页数为零。
扫描件、复杂表格和公式可能需要 OCR 或结构解析;升级会按页面提出,并在处理前说明上传范围和费用。
我们会公开什么
质量结论应该可以复现。生产基准将公开文档类型、解析器版本、输出与已知问题,而不是只展示一个无法解释的准确率。
后续会把相同的来源定位能力扩展到 PDF 转文本、PDF 转 JSON、图片转 Markdown 和文档转 Markdown,同时避免把关键词做成低价值重复页面。
先用一份真实 PDF 检查输出
本地文本提取免费,也不要求登录。