PDF から HTML
PDF の各ページの見た目を HTML に残し、既存テキストをコピー可能な transcript として別途含めます。
使い方
使い方
- 20 MB・20 ページ以下のローカル PDF を選択します。
- ブラウザー内で 96 DPI で変換します。ページ画像と抽出テキストは HTML に埋め込まれます。
- スタンドアロン HTML をダウンロードして開きます。PDF はアップロードされません。
自己完結型の HTML ドキュメント
PDF の各ページを埋め込み PNG 画像としてレンダリングし、見た目を保持します。既存の PDF テキストは各ページの下に選択・コピー可能な transcript として別に配置します。画像とテキストは 1 つの HTML に埋め込まれ、外部画像、スクリプト、フォント、ネットワークリクエストは追加されません。
ローカル処理と制限
選択した PDF はこのブラウザー内で処理します。1 ファイル 20 MB・20 ページ以下。96 DPI でレンダリングし、1 ページ 400 万ピクセル、合計 3,000 万ピクセル、HTML 出力 100 MB までです。
HTML で保持されない内容
これは見た目を保存するページアーカイブであり、意味構造や編集可能な PDF 再構築ではありません。ベクター画像は PNG になり、テキスト transcript はページ画像と位置合わせされません。スキャンページは画像として表示されますが OCR は行いません。リンク、フォーム、注釈、署名、文書構造、メタデータは引き継がれません。
よくある質問
あわせて知りたいこと
HTML は元のページの見た目を保ちますか?
各ページを 96 DPI の PNG として埋め込み、見える内容を画像で保持します。PDF のベクターやオブジェクトは編集できません。
テキストを選択・検索できますか?
PDF に埋め込まれたテキストは各ページの transcript として別途含まれます。ページのレイアウトや読み順とは一致しない場合があります。スキャン画像は OCR しません。
ダウンロードしたファイルは自己完結型ですか?
はい。ページ画像と transcript は 1 つの HTML に埋め込まれ、外部リソースやスクリプトは不要です。
PDF はアップロードされますか?
いいえ。PDF の描画、テキスト抽出、HTML 作成はすべてブラウザー内で行います。