文字与文档工具

PDF 转 HTML

在便携 HTML 文件中保留 PDF 每页的视觉外观,并附上可复制的已有文字。

优先本地处理无需注册隐私说明 ↗
尚未选择文件

选择一个不超过 20 MB、20 页的本地 PDF。页面按 96 DPI 渲染;扫描页不会进行 OCR。

独立 HTML 为每页包含 PNG 图像和单独的文字转录;不会保留可编辑矢量、链接、表单、批注、签名或文档结构。

选择 PDF 以开始。

渲染和文字提取均在浏览器本地完成。PDF 不会上传。

使用步骤

如何使用

  1. 选择一个不超过 20 MB、20 页的本地 PDF。
  2. 在浏览器中以 96 DPI 转换页面;页面图像和提取的文字都会嵌入 HTML。
  3. 下载并打开独立 HTML 文件。PDF 不会上传。

自包含的便携 HTML 文档

每页 PDF 都会渲染为内嵌 PNG 图像,以保留可见版式。PDF 中已有的文字会作为可选择、可复制的转录内容单独放在对应页面下方。图像和文字均嵌入同一个 HTML 文件,不添加远程图像、脚本、字体或网络请求。

本地处理与限制

所选 PDF 只在此浏览器处理。单个 PDF 最大 20 MB、20 页。页面按 96 DPI 渲染,每页最多 400 万像素,总计最多 3,000 万像素,HTML 输出最大 100 MB。

HTML 不会保留的内容

这是视觉页面归档,不是语义化或可编辑的 PDF 重建。矢量图会转换成 PNG;文字作为独立转录,不会与页面内容叠合。扫描页仍以图像显示,但不会 OCR。链接、表单、批注、签名、文档结构和元数据不会保留。

常见问题

你可能还想知道

HTML 会保留原 PDF 的页面外观吗?

每页都会以 96 DPI 渲染并嵌入 PNG,以图像形式保留可见内容;PDF 矢量和对象不可编辑。

可以选择或搜索文字吗?

PDF 中已有的文字也会按页作为独立转录嵌入。它不一定与版面或阅读顺序完全对应;纯扫描图像页不会 OCR。

下载的文件是自包含的吗?

是。页面图像和文字转录都直接嵌入一个 HTML 文件,无需外部资源或脚本。

PDF 会上传吗?

不会。PDF 渲染、文字提取和 HTML 创建都在浏览器本地完成。