PDF 转 HTML 与图片资源核对样例（2026-10-11）

source.pdf 是此前自编的两页 LaTeX 测试材料；保留原文标题和内容。本轮复用它已经完成的解析，只重新选择 HTML 导出，没有再次上传或 OCR。
original.html 是 Doc2X 实际下载的 HTML，字节未改。它引用一张 cdn.noedgeai.com 图片，本文件本身没有内嵌图片字节。
portable.html 是本地后处理副本：仅把该 img 的 src 换成 data:image/jpeg;base64，使用与 native-chart.jpg 完全相同的图片字节。它不是产品原生导出，也没有改写响应式样式。
checks.json 记录文件哈希与四个浏览器对照：原文件正常联网、只拦截该图片请求、同一拦截条件下打开内嵌副本、恢复请求后重开原文件。文字、三行表格和十处数学显示均相同。此测试不是整个浏览器离线测试。
已知限制：原 PDF 的图表顶部距离单位说明在识别中遗漏，两份 HTML 均未补写；HTML 连续流排版不保留两页 PDF 分页；内嵌副本在实测 312 CSS 像素宽度仍有横向溢出。
使用方法：解压后用浏览器打开 original.html 与 portable.html，对照 source.pdf。断开图片资源连接可能使 original.html 缺图；portable.html 的图像来自文件内字节。实际阅读仍需核对标题、表格、数学与图注。
本 ZIP 是本地整理的公开核对包，不是 Doc2X 一次导出的 ZIP。不含客户资料、账号或解析任务标识。
