PDFテキスト検索
PDFを選び、抽出可能なテキストから語句を検索します。ブラウザー内で全ページを検索し、一致数と走査ページ数を報告します。
PDFテキスト検索
PDF内の語句を検索
PDFを選択し、埋め込みテキストを検索します。
使い方
使い方
- 50 MB以下のPDFを1つ選択します。
- 語句を入力して、すべてのページを検索します。
- ローカルで作成された検索レポートを確認またはコピーします。
一致ページ番号
一致がある各ページと重複しない出現数をレポートに表示します。対応PDFは200ページまで全ページ検索しますが、ページ内位置のハイライトやジャンプはしません。
埋め込みテキストを検索
PDF.jsで各ページの選択可能なテキストを抽出し、大文字・小文字を区別せず文字列として検索します。一致総数と走査ページ数を報告しますが、位置のハイライトやOCRテキスト層の作成はしません。
スキャンページと読み取り順
OCR層のないスキャンページには検索可能なテキストがありません。複数段組みではPDFテキスト順が見た目の読順と異なる場合があり、行末のハイフンで単語が分割されることがあります。空白は正規化し、句読点はそのまま照合します。
ローカルでの処理
既存のPDF.jsワーカーで50 MB・200ページ以下のPDFをブラウザー内で解析します。文書や検索語をアップロード・保存・送信しません。長い検索はキャンセルできます。
よくある質問
あわせて知りたいこと
スキャンPDFを検索できますか?
ページにOCRテキスト層がすでにある場合のみ可能です。ページ画像の文字認識は行いません。
大文字・小文字を区別しますか?
大文字・小文字を区別せず、クエリを文字列として照合します。句読点は区別し、連続する空白は1つに正規化します。
各一致箇所を表示しますか?
一致総数と走査ページ数を報告しますが、位置のハイライトやページ移動はしません。
PDFはアップロードされますか?
いいえ。PDF.jsが選択ファイルをブラウザー内で読み込み、文書やクエリをサーバーに送信しません。