テキストと文書ツール

PDF から HTML

PDF の各ページの見た目を HTML に残し、既存テキストをコピー可能な transcript として別途含めます。

ブラウザ内で処理登録不要プライバシーの説明 ↗
ファイルが選択されていません

20 MB・20 ページ以下のローカル PDF を選択します。96 DPI で描画し、スキャンページの OCR は行いません。

スタンドアロン HTML には各ページの PNG 画像と個別のテキスト transcript が含まれます。編集可能なベクター、リンク、フォーム、注釈、署名、文書構造は保持されません。

PDF を選択してください。

描画とテキスト抽出はブラウザー内で行います。PDF はアップロードされません。

使い方

使い方

  1. 20 MB・20 ページ以下のローカル PDF を選択します。
  2. ブラウザー内で 96 DPI で変換します。ページ画像と抽出テキストは HTML に埋め込まれます。
  3. スタンドアロン HTML をダウンロードして開きます。PDF はアップロードされません。

自己完結型の HTML ドキュメント

PDF の各ページを埋め込み PNG 画像としてレンダリングし、見た目を保持します。既存の PDF テキストは各ページの下に選択・コピー可能な transcript として別に配置します。画像とテキストは 1 つの HTML に埋め込まれ、外部画像、スクリプト、フォント、ネットワークリクエストは追加されません。

ローカル処理と制限

選択した PDF はこのブラウザー内で処理します。1 ファイル 20 MB・20 ページ以下。96 DPI でレンダリングし、1 ページ 400 万ピクセル、合計 3,000 万ピクセル、HTML 出力 100 MB までです。

HTML で保持されない内容

これは見た目を保存するページアーカイブであり、意味構造や編集可能な PDF 再構築ではありません。ベクター画像は PNG になり、テキスト transcript はページ画像と位置合わせされません。スキャンページは画像として表示されますが OCR は行いません。リンク、フォーム、注釈、署名、文書構造、メタデータは引き継がれません。

よくある質問

あわせて知りたいこと

HTML は元のページの見た目を保ちますか?

各ページを 96 DPI の PNG として埋め込み、見える内容を画像で保持します。PDF のベクターやオブジェクトは編集できません。

テキストを選択・検索できますか?

PDF に埋め込まれたテキストは各ページの transcript として別途含まれます。ページのレイアウトや読み順とは一致しない場合があります。スキャン画像は OCR しません。

ダウンロードしたファイルは自己完結型ですか?

はい。ページ画像と transcript は 1 つの HTML に埋め込まれ、外部リソースやスクリプトは不要です。

PDF はアップロードされますか?

いいえ。PDF の描画、テキスト抽出、HTML 作成はすべてブラウザー内で行います。