PDF 文本搜索
选择 PDF 并搜索其中可提取的词句。本地扫描全文,报告总命中数和已扫描页数。
PDF 文本搜索
搜索 PDF 中的词语或短语
选择 PDF 并搜索其中的内嵌文本层。
使用步骤
如何使用
- 选择一个不超过 50 MB 的 PDF 文件。
- 输入词语或短语,然后搜索全部页面。
- 查看或复制本地生成的命中报告。
命中页码
报告列出每个命中页面及不重叠匹配次数。支持的 PDF 最多 200 页,并搜索其全部页面;不高亮或跳转到页内具体位置。
搜索内嵌文本层
使用 PDF.js 提取每页可选择的文本,并以不区分大小写的字面词句进行搜索。报告提供命中总数和扫描页数;不高亮位置,也不创建 OCR 文本层。
扫描页面与文本顺序
没有 OCR 层的扫描页没有可搜索文本。多栏版面的 PDF 文本顺序可能不同于视觉阅读顺序,行尾连字符也可能拆分单词。空白会规范化,标点按字面匹配。
本地隐私处理
使用现有 PDF.js worker 在浏览器本地解析一个不超过 50 MB、200 页的 PDF。文档和搜索词不会上传、保存或发送到服务器;可取消较长扫描。
常见问题
你可能还想知道
可以搜索扫描版 PDF 吗?
仅当页面已有 OCR 文本层时可以。本工具不会识别页面图片中的文字。
搜索区分大小写吗?
不区分大小写,按字面匹配查询词;标点有意义,连续空白会规范为一个空格。
会显示每个匹配位置吗?
报告命中总数和扫描页数,但不高亮匹配位置,也不跳转页面。
PDF 会上传吗?
不会。PDF.js 在浏览器本地读取所选文件,页面不会向服务器发送文档或查询词。