PDF を RTF に変換(テキスト transcript)
PDF に含まれる既存のテキストから RTF transcript を作成します。レイアウトを維持する変換ではありません。
LOCAL TEXT TRANSCRIPT
PDF テキストを RTF に抽出
元のレイアウトを維持せず、ページごとのテキスト transcript を作成します。
埋め込みテキストのみを抽出します。スキャンページにはテキストなしと表示し、OCR は行いません。表、画像、フォント、レイアウト、読み順は再構築しません。
PDF の解析と RTF 生成はブラウザー内で行われます。ファイルはアップロードされません。
使い方
使い方
- 50 MB・100 ページ以下の PDF を選択します。
- PDF のテキストをページごとにローカル抽出します。
- Unicode 対応の RTF transcript をダウンロードします。スキャンページには注記し、OCR は行いません。
テキスト transcript、レイアウト変換ではありません
PDF.js で既存のテキストオブジェクトを読み取り、ページマーカー付き RTF に書き出します。段組み、表、画像、フォント、スタイル、ヘッダー、フッター、意味構造は再構築しません。
スキャンページと読み順
画像のみのページにはテキストなしの注記を付けます。OCR は行いません。テキストは PDF.js の項目順で出力されるため、段組みや脚注では自然な読み順と異なる場合があります。
ローカル処理と上限
PDF はブラウザー内で処理され、アップロードされません。1 ファイル 50 MB・100 ページまでです。開けない暗号化または破損 PDF は拒否されます。
よくある質問
あわせて知りたいこと
RTF は PDF と同じ見た目になりますか?
いいえ。ページマーカー付きテキスト transcript であり、レイアウト変換ではありません。表、画像、フォント、文書構造は再現されません。
スキャンページも読み取れますか?
いいえ。埋め込みテキストのみを読み取り、抽出できないページを示します。OCR は行いません。
PDF はアップロードされますか?
いいえ。解析と RTF 生成はブラウザー内で行います。