画像からテキストを抽出
ローカル OCR エンジンで 1 枚の画像から印刷文字を抽出します。画像はこのブラウザー内に保持されます。主な言語を選択してください。
使い方
使い方
- 3 MB 以下、4 メガピクセル以下の JPEG、PNG、WebP 画像を 1 枚選びます。
- 画像内の主な言語を選んで認識を開始します。OCR エンジンと言語データは必要時にこのサイトから読み込まれます。
- 認識結果を確認・編集し、コピーするか UTF-8 テキストとしてダウンロードします。
4 言語に対応したローカル OCR
Tesseract.js とこのサイトが提供する言語データを使い、お使いの端末で認識します。画像をアップロードしたり AI サービスへ送信したりしません。英語、簡体字中国語、日本語、韓国語から画像の主な言語を選択できます。
画像とテキストのサイズ制限
3 MB 以下、4 メガピクセル以下の JPEG、PNG、WebP を 1 枚処理します。結果が 120,000 文字を超える場合は、黙って切り捨てずに拒否します。初回は OCR エンジンと選択した圧縮言語モデルをこのサイトから取得し、ブラウザーにキャッシュする場合があります。
OCR は正確な書き起こしを保証しません
認識品質は鮮明さ、コントラスト、向き、フォント、手書き、言語によって異なります。読みやすい印刷文字を対象とし、翻訳、レイアウト保持、書類項目の抽出、正確性の保証は行いません。必ず結果を確認してください。
よくある質問
あわせて知りたいこと
画像はアップロードされますか?
いいえ。画像は端末上のブラウザー worker でデコード・処理されます。OCR コードと選択した言語モデルのみ tools.hellokeyboard.com からダウンロードします。
どの言語を認識できますか?
英語、簡体字中国語、日本語、韓国語から選択できます。画像の大部分を占める言語を選んでください。翻訳は行いません。
初回の処理が遅いのはなぜですか?
OCR エンジンと選択した言語モデルをこのサイトから読み込むためです。Tesseract.js は次回以降のためにブラウザーへキャッシュする場合があります。
手書きや元のレイアウトも認識できますか?
印刷文字を対象に編集可能なプレーンテキストを返します。手書き、段組み、表、回転、特殊なフォントでは精度や読み取り順が低下することがあります。