PDF を Excel に変換(テキスト transcript)
ページ別テキストを検索・並べ替えできる XLSX を作成します。PDF の表を認識・再構成しません。
LOCAL TEXT TRANSCRIPT
PDF テキストを Excel ワークブックに抽出
PDF の各ページをワークシートの 1 行にします。表認識ではなくテキスト transcript です。
埋め込みテキストのみ抽出します。スキャンページには注記し、OCR は行いません。表、セル、数式、画像、読み順は再構築されません。
PDF の解析とワークブック生成はブラウザー内で行われます。アップロードされません。
使い方
使い方
- 50 MB・100 ページ以下の PDF を選択します。
- 既存テキストをページごとにローカル抽出します。
- ページ列とテキスト列を含む XLSX をダウンロードします。スキャンページには注記し、OCR は行いません。
Excel ワークブック
XLSX は Page 列と Text 列を持つ有効な Office Open XML ワークブックです。検索や並べ替えに使えますが、セル、数式、元のレイアウトは認識しません。
埋め込みテキストのみ
PDF.js が取得できる順序でテキストを読み取ります。画像のみのページには注記し、OCR は行いません。表、列、脚注、意味構造は再構築されません。
ローカル処理と上限
PDF 解析とワークブック生成はブラウザー内で行われ、アップロードされません。1 ファイル 50 MB・100 ページ、抽出文字 2,500 万文字、出力 100 MB までです。
よくある質問
あわせて知りたいこと
PDF の表を認識しますか?
いいえ。ページごとに 1 行の transcript を出力し、表のセル、行、列、数式は認識しません。
スキャンページも読み取れますか?
いいえ。埋め込みテキストのみを読み取り、抽出できないページを示します。OCR はありません。
PDF はアップロードされますか?
いいえ。PDF の解析と XLSX 生成はブラウザー内で行います。