来源是 Markdown、PDF、图片还是 GitHub README?
只走与真实来源匹配的分支。Markdown 发布、扫描 PDF OCR、图片抽取和 README 拉取需要不同证据与清理方式。
Elysia Tools
导航
Workflow Playbook
从 PDF 或图片恢复 Markdown,将 Markdown 导出为 PDF、HTML、幻灯片、报告、纯文本、JSON 或 CSV,并验证下游可用性。
专题
从 PDF 或图片恢复 Markdown,将 Markdown 导出为 PDF、HTML、幻灯片、报告、纯文本、JSON 或 CSV,并验证下游可用性。
本指南将当前任务范围转化为可复核的交付结果。请保留源文件、中间产物和关键判断,让后续协作者能够理解检查了什么以及为什么这样处理。
保留原始来源文件或粘贴的 Markdown,并先判断目标是恢复、发布、结构化提取还是纯文本清理。
选择转换器前,明确目标渠道、样式要求、表格处理、OCR 容错和下游解析器预期。
决策点: 来源是 Markdown、PDF、图片还是 GitHub README?. 只走与真实来源匹配的分支。Markdown 发布、扫描 PDF OCR、图片抽取和 README 拉取需要不同证据与清理方式。
决策点: 结果是给人读,给机器读,还是两者都要?. PDF、主题 PDF、报告包、幻灯片或 HTML 面向阅读;只有当 Markdown 结构或表格要交给系统时,才导出 JSON 或 CSV。
决策点: 转换后哪些内容必须保留?. 检查标题、链接、代码块、表格、页面顺序、图片识别文本,以及下游读者或解析器依赖的元数据。
先判断输入是现成 Markdown、带文本层 PDF、扫描 PDF、图片还是 GitHub README。只用匹配来源的分支恢复可编辑 Markdown,然后先检查第一版结果。 使用 pdf-to-markdown, scanned-pdf-ocr-to-markdown, ai-image-to-markdown, github-readme-to-pdf.
如果目标是可读文本或轻量审阅件,就有意识地移除语法或转换为 HTML,同时检查链接、代码块、表格和标题层级。 使用 markdown-to-plain-text, markdown-to-html.
按交付物选择 PDF 分支:通用 Markdown PDF、带主题的打印 PDF、多文件报告包,或一页一张的幻灯片 PDF。 使用 markdown-to-pdf-converter, markdown-to-pdf-theme-pack, markdown-report-bundler, md-slide-deck-to-pdf.
如果 Markdown 中的表格或结构章节要给另一个系统使用,只导出所需机器格式,并在解析后比较代表性字段或行。 使用 markdown-to-json, markdown-to-csv.
工作流指南
先判断输入是现成 Markdown、带文本层 PDF、扫描 PDF、图片还是 GitHub README。只用匹配来源的分支恢复可编辑 Markdown,然后先检查第一版结果。
如果目标是可读文本或轻量审阅件,就有意识地移除语法或转换为 HTML,同时检查链接、代码块、表格和标题层级。
按交付物选择 PDF 分支:通用 Markdown PDF、带主题的打印 PDF、多文件报告包,或一页一张的幻灯片 PDF。
如果 Markdown 中的表格或结构章节要给另一个系统使用,只导出所需机器格式,并在解析后比较代表性字段或行。
只走与真实来源匹配的分支。Markdown 发布、扫描 PDF OCR、图片抽取和 README 拉取需要不同证据与清理方式。
PDF、主题 PDF、报告包、幻灯片或 HTML 面向阅读;只有当 Markdown 结构或表格要交给系统时,才导出 JSON 或 CSV。
检查标题、链接、代码块、表格、页面顺序、图片识别文本,以及下游读者或解析器依赖的元数据。