文字エンコーディング検出
テキストまたは16進バイトを貼り付け、ブラウザーで確認できる証拠と安全なプレビューを調べます。
文字エンコーディング検出
使い方
使い方
- テキストか16進バイトを選びます。
- 100,000文字まで貼り付けて検査します。
- 候補、バイトの根拠、制限を読みます。
限定された符号化の根拠
UTF-8、UTF-16LE/BE、UTF-32LE/BEのBOMを識別します。BOMなしではUTF-8を厳密に検証し、ASCIIをその部分集合と表示します。元の符号化やISO-8859-1、Windows-1252を推測せず、任意の変換もしません。16進数は完全なバイト対が必要です。不正なUTF-8はエラーとし、プレビューのU+FFFD置換は妥当性の証明ではありません。100,000文字までローカルで処理します。
よくある質問
あわせて知りたいこと
すべての符号化を識別しますか?
いいえ。BOMのない旧来の符号化は一意に判定できません。