Teksto at mga dokumento na tool

I-extract ang Natatanging Salita

Mag-paste ng text upang isang kopya lang ng bawat salita ang maiwan sa orihinal na ayos ng paglitaw.

Lokal na pinoproseso sa browserHindi kailangan ng accountMga detalye ng pagkapribado ↗

Ang Unicode letter at number ay tina-tokenize; separator lang ang punctuation at whitespace.

Paano gamitin

Paano gamitin

  1. Mag-paste ng hanggang 100,000 character.
  2. Piliin kung mahalaga ang laki ng titik.
  3. I-extract at kopyahin ang listahang nasa unang paglitaw.

Pag-tokenize ng salita

Gumagamit ng Intl.Segmenter word granularity kapag available at pinapanatili ang mga segment na word-like. Sa fallback, magkakasunod na Unicode letter at number lang ang salita. Separator ang punctuation, symbol, at whitespace.

Laki ng titik at ayos

Inihahambing ng case-sensitive mode ang eksaktong token. Sa ignore-case mode, Unicode toLocaleLowerCase ang gamit sa paghahambing habang pinapanatili ang unang spelling.

Unicode at whitespace

Sinusuportahan ang Unicode letter at number. Ang space, tab, line break at ibang separator ay naghihiwalay lang ng token at hindi kasama sa resulta.

Mga madalas itanong

Maaari mo ring alamin

Inaayos ba ayon sa alpabeto?

Hindi. Nananatili ang unang pagkakasunod ng paglitaw.

Mahalaga ba ang laki ng titik?

Oo bilang default. I-on ang Ignore case para pagsamahin ang magkaparehong Unicode lowercase form.

Ina-upload ba ang text?

Hindi. Lokal sa browser ang extraction.