扫描版 PDF
从图片页面恢复文字与阅读顺序,并让低置信度内容保持可检查。
结构化输出 · 单次匿名任务
把文本型、扫描型或混合型 PDF 转为清晰 Markdown,用于继续编辑、AI 上下文、RAG 流程和知识库导入。导出前可先检查恢复后的文档结构。
优先恢复阅读结构,而不是页面坐标
检查标题、表格、公式和结构警告
让 Markdown 与本地图片资源保持在一起
支持的文档
PDF 是页面格式,不是文档结构。转换流程围绕复制粘贴时最容易丢失语义的版面进行设计。
从图片页面恢复文字与阅读顺序,并让低置信度内容保持可检查。
在 Markdown 能可靠表达时,保留表头、数据行和单元格关系。
把行内与独立公式转为可编辑数学文本,而不是压平为截图。
一个专注的流程
浏览器先检查文件类型、大小和 PDF 签名,再允许创建任务。
转换流程识别文字、版面、表格、公式和图片资源。
检查渲染后的层级,需要精确编辑时可以切换到 Markdown 源码。
复制 Markdown 源码,或下载包含本地图片资源的 ZIP。
常见问题
第一版优先提供范围明确、可以解释的单次流程,不加入账号历史或静默回退。
选择一个 PDF,开始转换,检查恢复后的结构,然后在当前浏览器中复制 Markdown 或下载 ZIP。
计划中的处理流程支持文本型、扫描型和混合型 PDF。图片质量较低时,扫描结果仍需要人工检查。
规则表格可以输出为 Markdown 表格,公式可以输出为可编辑数学文本。复杂合并单元格和低置信度公式需要标记检查。
MVP 设计为单次匿名任务。交付、失败、取消、超时或过期后,服务端文件进入清理。当前本地预览模式不会上传所选文件。