テキストと文書ツール

異なる単語を抽出

テキストを貼り付け、各単語を1回だけ残して初出順を保ちます。

ブラウザ内で処理登録不要プライバシーの説明 ↗

Unicode の文字と数字を単語に分け、句読点と空白は区切りとして扱います。

使い方

使い方

  1. 最大100,000文字を貼り付けます。
  2. 大文字と小文字を区別するか選びます。
  3. 初出順の結果を抽出してコピーします。

単語の分割

対応ブラウザーでは Intl.Segmenter の単語粒度を使い、word-like と判定された部分を残します。フォールバックでは連続する Unicode の文字と数字を単語にします。

大文字と順序

区別するモードは元の単語を比較します。区別しないモードは Unicode の toLocaleLowerCase で比較し、最初に現れた表記を残します。

Unicode と空白

Unicode の文字と数字に対応します。空白、タブ、改行などは区切りであり、結果には含まれません。

よくある質問

あわせて知りたいこと

アルファベット順に並びますか?

いいえ。初めて現れた順序を保ちます。

大文字と小文字は影響しますか?

初期状態では影響します。「大文字と小文字を無視」を選ぶと Unicode の小文字形が同じ単語をまとめます。

テキストはアップロードされますか?

いいえ。このブラウザー内で処理します。