PDF 转 ODS(文字转录)
生成可筛选和搜索逐页文字的真实 ODS 工作簿;不会识别或重建 PDF 表格。
LOCAL TEXT TRANSCRIPT
提取 PDF 文字并生成 ODS
每页写入工作表一行。这是文字转录稿,不是表格识别。
仅提取嵌入文字。扫描页会标记为无文字;不执行 OCR。不会识别表格、单元格、列、公式、图片或阅读顺序。
PDF 解析和 ODS 生成均在浏览器本地完成,不会上传文件。
使用步骤
如何使用
- 选择一个不超过 50 MB、100 页的 PDF。
- 在本地逐页提取现有文字对象。
- 下载带有页码和文字列的 ODS 工作簿。扫描页会标注;不会执行 OCR。
真实 OpenDocument 电子表格
下载的 ODS 是有效的 OpenDocument 电子表格包,包含“页码”和“文字转录”两列,可用于搜索或筛选逐页文本;它不会识别表格、单元格、公式或文档版式。
仅提取嵌入文字
PDF.js 按其现有顺序读取文字对象。纯图像页面会显示无文字提示;不执行 OCR。不会重建多栏顺序、表格、脚注或语义结构。
本地处理与限制
PDF 解析和电子表格生成均在浏览器本地完成,不会上传。单个 PDF 不超过 50 MB、100 页;提取文字≤2,500 万字符,输出≤100 MB。
常见问题
你可能还想知道
能识别 PDF 表格吗?
不能。工具每页生成一行文字,不识别表格的行、列、公式或单元格。
能读取扫描页吗?
不能。工具只读取嵌入文字,并标注没有可提取文字的页面;不包含 OCR。
PDF 会上传吗?
不会。PDF 解析和 ODS 生成都在浏览器本地完成。