PDF を ODT に変換(テキスト transcript)
PDF に含まれる既存のテキストから ODT transcript を作成します。レイアウトを維持する変換ではありません。
LOCAL TEXT TRANSCRIPT
PDF テキストを ODT に抽出
元のレイアウトを維持せず、編集可能なページ別 transcript を作成します。
埋め込みテキストのみを抽出します。スキャンページにはテキストなしと表示し、OCR は行いません。表、画像、フォント、レイアウト、読み順は再構築しません。
PDF の解析と ODT 生成はブラウザー内で行われます。ファイルはアップロードされません。
使い方
使い方
- 50 MB・100 ページ以下の PDF を選択します。
- 埋め込みテキストをページごとにローカル抽出します。
- 標準 ODT transcript をダウンロードします。スキャンページには注記し、OCR は行いません。
編集可能なテキスト transcript
ブラウザーで OpenDocument Text パッケージを作成し、PDF.js で取得できるテキストのみをページごとの段落に出力します。段組み、表、画像、フォント、スタイル、ヘッダー、フッター、文書の意味構造は再構築しません。
スキャンページと読み順
画像のみのページにはテキストなしの注記を付けます。OCR は行いません。テキストは PDF.js の項目順で出力されるため、段組みや脚注では自然な読み順と異なる場合があります。
ローカル処理と上限
PDF の解析と ODT 生成はブラウザー内で行われ、アップロードされません。1 ファイル 50 MB・100 ページまでです。開けない暗号化または破損 PDF は拒否されます。
よくある質問
あわせて知りたいこと
ODT は PDF と同じ見た目になりますか?
いいえ。ページマーカー付きの編集可能なテキスト transcript であり、レイアウト変換ではありません。表、画像、フォント、文書構造は再現されません。
スキャンページも読み取れますか?
いいえ。埋め込みテキストのみを読み取り、抽出できないページを示します。OCR は行いません。
PDF はアップロードされますか?
いいえ。PDF の解析と ODT 生成はブラウザー内で行います。