本页内容
检查源文档,再完成后续处理
- 确认源文件可正常打开,旧格式先另存。
- 上传 DOCX/PPTX,检查代表性 PDF 页面。
- 发现异常时在源软件修正或另存 PDF,再比较。
- 预览正确后下载或继续解析,并保留原文件。
上传 Office 文件,先看预览
预览正确后下载或继续解析,并保留原文件。
先了解这几件事
转换后的 PDF 预览若已缺字或公式错位,应先修正这一阶段,再继续识别或翻译。检查源文档的字体、对象与页面设置;必要时在原办公软件另存 PDF,并比较同页内容。重复 OCR 不能恢复预览中已经缺失的信息。
- 输入
- DOCX、PPTX 或办公软件另存的 PDF
- 输出
- 核对可见内容后的 PDF
- 核对重点
- 检查源文档 → 逐页核对 PDF 预览 → 确认后继续处理
用同一位置比较三份内容
比较原 DOCX/PPTX、Office 转出的 PDF 和后续解析结果。最先出现差异的阶段决定处理方向;不要把转换缺字与识别错字混为一谈。
公式对象可能有兼容差异
Word 原生公式、图片公式和第三方嵌入对象不是同一种结构。先看源文件能否正常打开,再核对 PDF 中分式、根号与上下标的完整性。
页面设置影响结果
纸张尺寸、方向、分页和字体变化可能造成图表截断。PPT 的备注、动画和隐藏对象也不等于会进入普通 PDF 页面,应另行保留原始工程。
预览后可以先下载 PDF
Office 转换与 OCR、翻译是不同步骤。可以先下载转换好的 PDF 暂不处理;确认内容后再进入解析,处理条件与可用额度以工作台为准。
详细操作教程
从解析或翻译入口上传 DOCX/PPTX,检查转换后再提交任务。
常见问题
公式在预览里已经乱码,再 OCR 能修好吗?
不能指望 OCR 恢复缺失原文,应先得到正确的 PDF 页面。
只需要 PDF 也必须解析吗?
不必,先转换预览后可以下载 PDF 并暂不处理。
内容核对:2026-10-09 · 功能条件与配额以当前产品界面为准