पाठ और दस्तावेज़ टूल

अलग शब्द निकालें

टेक्स्ट पेस्ट करें; हर शब्द की एक प्रति रखें और उसका पहला क्रम बनाए रखें।

ब्राउज़र में ही कामखाता बनाने की ज़रूरत नहींगोपनीयता विवरण ↗

Unicode अक्षर और अंक tokenized होते हैं; punctuation और whitespace token अलग करते हैं।

उपयोग कैसे करें

उपयोग कैसे करें

  1. अधिकतम 100,000 वर्ण पेस्ट करें।
  2. चुनें कि अक्षर-केस मायने रखे या नहीं।
  3. पहली उपस्थिति के क्रम वाली सूची निकालें और कॉपी करें।

शब्द tokenization

उपलब्ध होने पर browser Intl.Segmenter की word granularity और word-like segment उपयोग होते हैं। fallback में लगातार Unicode अक्षर और अंक शब्द माने जाते हैं। punctuation, symbol और whitespace separator हैं।

Case और क्रम

Case-sensitive मोड मूल token मिलाता है। Ignore case मोड Unicode toLocaleLowerCase mapping से मिलाता है और पहली spelling रखता है। परिणाम हमेशा पहली उपस्थिति के क्रम में रहता है।

Unicode और whitespace

Unicode अक्षर और अंकों का समर्थन है। space, tab, line break और अन्य separator केवल token अलग करते हैं और परिणाम में नहीं आते।

अक्सर पूछे जाने वाले सवाल

आप यह भी जानना चाहेंगे

क्या सूची alphabetically sort होती है?

नहीं। पहली बार आने का क्रम बना रहता है।

क्या case मायने रखता है?

डिफ़ॉल्ट रूप से हाँ। Ignore case चालू करने पर समान Unicode lowercase form वाले शब्द मिल जाते हैं।

क्या text upload होता है?

नहीं। Extraction इसी browser में स्थानीय रूप से होती है।