テキストと文書ツール

単語・語句頻度分析

検索語を指定せず頻出語を確認します。入力時に自動更新し、必要に応じて除外語を入力できます。

ブラウザ内で処理登録不要プライバシーの説明 ↗

文章を貼り付けて単語と語句を集計します。

文章は50,000 UTF-16コード単位、除外語は2,000単位以内。上位100行を表示します。

Intl.Segmenterはブラウザーの言語データで単語区間を識別します。文章の言語を選択してください。特に中国語と日本語の境界はブラウザーによって変わります。NFC正規化とロケール別小文字変換でまとめ、語幹化やアクセント除去はしません。除外リストは空で始まり、入力した各トークンを除外します。語句は元の隣接トークンから作り、句読点や改行をまたぎます。除外語を含む組は削除し、その隙間をつなぎません。重複する組も数え、2回以上の組だけ表示します。割合は単語も語句も回数 ÷ 元の全トークン × 100で、合計100になる構成比ではありません。回数降順、同数は表記順です。字面の頻度のみで、意味理解、関連性スコア、理想密度、順位予測はありません。

使い方

使い方

  1. 文章を貼り付け、言語を選びます。
  2. 必要な場合は除外語を入力します。
  3. 単語、繰り返す語句、割合を確認します。

集計方法と制限

Intl.Segmenterはブラウザーの言語データで単語区間を識別します。文章の言語を選択してください。特に中国語と日本語の境界はブラウザーによって変わります。NFC正規化とロケール別小文字変換でまとめ、語幹化やアクセント除去はしません。除外リストは空で始まり、入力した各トークンを除外します。語句は元の隣接トークンから作り、句読点や改行をまたぎます。除外語を含む組は削除し、その隙間をつなぎません。重複する組も数え、2回以上の組だけ表示します。割合は単語も語句も回数 ÷ 元の全トークン × 100で、合計100になる構成比ではありません。回数降順、同数は表記順です。字面の頻度のみで、意味理解、関連性スコア、理想密度、順位予測はありません。

よくある質問

あわせて知りたいこと

文章は送信されますか?

いいえ。文章と除外語はローカル処理で、アップロードや保存はありません。