PDF 转 XLSX(文字转录)
生成可搜索和筛选逐页文字的真实 XLSX 工作簿;不会识别或重建 PDF 表格。
LOCAL TEXT TRANSCRIPT
提取 PDF 文字并生成 Excel 工作簿
每个 PDF 页面生成一行。这是文字转录稿,不是表格识别。
仅提取嵌入文字。扫描页会标注,不执行 OCR;不会重建表格、单元格、公式、图片或阅读顺序。
PDF 解析与工作簿生成均在浏览器本地完成,文件不会上传。
使用步骤
如何使用
- 选择一个不超过 50 MB、100 页的 PDF。
- 在本地逐页提取现有文字对象。
- 下载带有页码和文字列的 XLSX 工作簿。扫描页会标注;不会执行 OCR。
真实 Excel 工作簿
下载的 XLSX 是有效的 Office Open XML 工作簿,包含页码和文字两列,可搜索或筛选,但不会识别单元格、公式或原始版式。
仅提取嵌入文字
PDF.js 按其可读取顺序提取文字对象。纯图像页面会显示无文字提示;不执行 OCR,也不重建表格、列、脚注或语义结构。
隐私与限制
PDF 解析和工作簿生成均在浏览器本地完成。单个 PDF 不超过 50 MB、100 页;提取文字不超过 2,500 万字符,输出不超过 100 MB。
常见问题
你可能还想知道
能识别 PDF 表格吗?
不能。工具每页生成一行文字,不识别表格的单元格、行、列或公式。
能读取扫描页吗?
不能。工具只读取嵌入文字,并标注没有可提取文字的页面;不包含 OCR。
PDF 会上传吗?
不会。PDF 解析和 XLSX 生成都在浏览器本地完成。