DOC2X使用指南

Word 转 Markdown:正文、公式与图片

将 DOCX 先转换并预览 PDF,再解析为 Markdown。核对标题、阅读顺序、数学公式和图片资源;旧 DOC 先另存,不把内容提取当成保留批注、修订或原 Word 工程。

你的文件
DOCX;旧 DOC 先另存为 DOCX 或 PDF
得到什么
核对后的 Markdown 与相关图片资源
操作流程示意

Word 转 Markdown:正文、公式与图片

01

检查 PDF 预览

02

核对正文与公式

03

导出完整 MD 资源

操作流程示意 · 在工具中处理自己的文件后,再核对实际结果

本页内容

检查 PDF 预览,再完成后续处理

  1. 上传 DOCX,旧 DOC 先用办公软件另存。
  2. 检查转换后的 PDF,重点看公式、字体、页边和图表。
  3. 确认解析条件后处理,并按原文核对识别顺序。
  4. 导出 Markdown 与图片,在目标编辑器核对后保存原 DOCX。
上传 DOCX,先检查预览

导出 Markdown 与图片,在目标编辑器核对后保存原 DOCX。

先了解这几件事

Doc2X 的 Word 转 Markdown 经过 DOCX → PDF 预览 → 文档解析 → Markdown 导出。先确认 PDF 中的字体、分页和图表正确,再识别内容。Markdown 适合继续整理正文结构;批注、修订、域和原 Word 对象应另外保留。

输入
DOCX;旧 DOC 先另存为 DOCX 或 PDF
输出
核对后的 Markdown 与相关图片资源
核对重点
检查 PDF 预览 → 核对正文与公式 → 导出完整 MD 资源

先分清文件转换与识别

Office 转换生成可预览、可下载的 PDF。可以先下载 PDF、暂不处理;选择继续解析才进入内容识别。需要翻译时,在上传前确认语言和术语表等设置,不要把这几个步骤当成一次不可检查的黑箱。

先修正预览中的问题

如果 PDF 预览已经缺字、公式错位或图表被截断,后续解析不能还原没有显示出的原文。先在 Word/WPS 中检查字体、分页与嵌入对象,另存 PDF 后重新预览。

导出后检查结构和资源

在目标 Markdown 编辑器检查标题层级、列表、数学定界及表格支持。图片引用不是图片文件;下载包应完整解压,移动正文时同步维护图片目录。

什么时候不适合走这条路径

要保留 Word 修订、批注、可更新目录或原生图表时,应继续保存 DOCX。已有干净的 Markdown 源码也无需先放进 Word 再识别。本流程解决可见内容的提取与整理。

详细操作教程

常见问题

Word 转 Markdown 会保留批注吗?

不能据此保证。此流程经过页面 PDF,原文档的批注、修订和对象结构应另行保留。

为什么先生成 PDF?

当前 Office 入口先提供 PDF 预览,让你确认可见内容,再决定是否继续解析。

内容核对:2026-10-09 · 功能条件与配额以当前产品界面为准