異なる単語を抽出
テキストを貼り付け、各単語を1回だけ残して初出順を保ちます。
Unicode の文字と数字を単語に分け、句読点と空白は区切りとして扱います。
使い方
使い方
- 最大100,000文字を貼り付けます。
- 大文字と小文字を区別するか選びます。
- 初出順の結果を抽出してコピーします。
単語の分割
対応ブラウザーでは Intl.Segmenter の単語粒度を使い、word-like と判定された部分を残します。フォールバックでは連続する Unicode の文字と数字を単語にします。
大文字と順序
区別するモードは元の単語を比較します。区別しないモードは Unicode の toLocaleLowerCase で比較し、最初に現れた表記を残します。
Unicode と空白
Unicode の文字と数字に対応します。空白、タブ、改行などは区切りであり、結果には含まれません。
よくある質問
あわせて知りたいこと
アルファベット順に並びますか?
いいえ。初めて現れた順序を保ちます。
大文字と小文字は影響しますか?
初期状態では影響します。「大文字と小文字を無視」を選ぶと Unicode の小文字形が同じ単語をまとめます。
テキストはアップロードされますか?
いいえ。このブラウザー内で処理します。