DOC2X使用指南

Word、PPT 转 PDF:公式乱码与预览排查

Office 转 PDF 后出现缺字、公式错位或图表截断时,先在 PDF 预览定位问题。检查源文件字体、嵌入对象和分页,必要时从 Word/WPS 导出 PDF,再继续识别或翻译。

你的文件
DOCX、PPTX 或办公软件另存的 PDF
得到什么
核对可见内容后的 PDF
操作流程示意

Word、PPT 转 PDF:公式乱码与预览排查

01

检查源文档

02

逐页核对 PDF 预览

03

确认后继续处理

操作流程示意 · 在工具中处理自己的文件后,再核对实际结果

本页内容

检查源文档,再完成后续处理

  1. 确认源文件可正常打开,旧格式先另存。
  2. 上传 DOCX/PPTX,检查代表性 PDF 页面。
  3. 发现异常时在源软件修正或另存 PDF,再比较。
  4. 预览正确后下载或继续解析,并保留原文件。
上传 Office 文件,先看预览

预览正确后下载或继续解析,并保留原文件。

先了解这几件事

转换后的 PDF 预览若已缺字或公式错位,应先修正这一阶段,再继续识别或翻译。检查源文档的字体、对象与页面设置;必要时在原办公软件另存 PDF,并比较同页内容。重复 OCR 不能恢复预览中已经缺失的信息。

输入
DOCX、PPTX 或办公软件另存的 PDF
输出
核对可见内容后的 PDF
核对重点
检查源文档 → 逐页核对 PDF 预览 → 确认后继续处理

用同一位置比较三份内容

比较原 DOCX/PPTX、Office 转出的 PDF 和后续解析结果。最先出现差异的阶段决定处理方向;不要把转换缺字与识别错字混为一谈。

公式对象可能有兼容差异

Word 原生公式、图片公式和第三方嵌入对象不是同一种结构。先看源文件能否正常打开,再核对 PDF 中分式、根号与上下标的完整性。

页面设置影响结果

纸张尺寸、方向、分页和字体变化可能造成图表截断。PPT 的备注、动画和隐藏对象也不等于会进入普通 PDF 页面,应另行保留原始工程。

预览后可以先下载 PDF

Office 转换与 OCR、翻译是不同步骤。可以先下载转换好的 PDF 暂不处理;确认内容后再进入解析,处理条件与可用额度以工作台为准。

详细操作教程

常见问题

公式在预览里已经乱码,再 OCR 能修好吗?

不能指望 OCR 恢复缺失原文,应先得到正确的 PDF 页面。

只需要 PDF 也必须解析吗?

不必,先转换预览后可以下载 PDF 并暂不处理。

内容核对:2026-10-09 · 功能条件与配额以当前产品界面为准