고유 단어 추출
텍스트를 붙여 넣으면 각 단어를 한 번만 남기고 처음 나온 순서를 유지합니다.
Unicode 문자와 숫자를 토큰화하며 문장 부호와 공백은 토큰을 나눕니다.
사용 방법
사용 방법
- 최대 100,000자를 붙여 넣습니다.
- 대소문자 구분 여부를 선택합니다.
- 처음 나타난 순서의 결과를 추출하고 복사합니다.
단어 토큰화
가능한 브라우저에서는 Intl.Segmenter 단어 단위와 word-like 표식을 사용합니다. 폴백은 연속된 Unicode 문자와 숫자를 단어로 유지합니다.
대소문자와 순서
구분 모드는 원래 토큰을 비교합니다. 무시 모드는 Unicode toLocaleLowerCase 결과로 비교하면서 처음 보인 표기를 유지합니다.
Unicode와 공백
Unicode 문자와 숫자를 지원합니다. 공백, 탭, 줄바꿈 및 기타 구분자는 토큰을 나눌 뿐 결과에 포함되지 않습니다.
자주 묻는 질문
더 알아보기
알파벳순으로 정렬되나요?
아니요. 처음 나타난 순서를 유지합니다.
대소문자가 결과에 영향을 주나요?
기본적으로 영향을 줍니다. 대소문자 무시를 켜면 Unicode 소문자 형태가 같은 단어를 합칩니다.
텍스트가 업로드되나요?
아니요. 이 브라우저에서 로컬로 처리합니다.