लंबे शब्द निकालें
पाठ चिपकाएँ, न्यूनतम लंबाई चुनें और लंबे शब्द स्थानीय रूप से सूचीबद्ध करें।
उपयोग कैसे करें
उपयोग कैसे करें
- जाँचने के लिए पाठ चिपकाएँ।
- हर शब्द के लिए 1–1,000 Unicode code point की न्यूनतम लंबाई चुनें।
- मिलते अद्वितीय शब्द निकालें, फिर परिणाम कॉपी या डाउनलोड करें।
Unicode शब्द और लंबाई के नियम
उपलब्ध होने पर Intl.Segmenter के शब्द-जैसे खंड लिए जाते हैं जिनमें Unicode अक्षर या अंक हों। लंबाई Unicode code point की संख्या है: supplementary वर्ण एक गिना जाता है और combining mark अलग गिना जाता है। segmentation उपलब्ध न हो तो सावधान Unicode अक्षर/अंक fallback उपयोग होता है।
अद्वितीय, स्थिर परिणाम
Case और accent सहित बिल्कुल समान पाठ को duplicate माना जाता है; पहली वर्तनी और स्थान रखा जाता है। परिणाम लंबाई के घटते क्रम में हैं और बराबर लंबाई पर पहली उपस्थिति का क्रम रहता है। प्रसंस्करण ब्राउज़र में होता है और इनपुट सीमा 100,000 UTF-16 code unit है।
अक्सर पूछे जाने वाले सवाल
आप यह भी जानना चाहेंगे
लंबाई कैसे गिनी जाती है?
Unicode code point गिने जाते हैं, UTF-16 code unit या दिखने वाले grapheme cluster नहीं। Supplementary वर्ण एक गिना जाता है; मूल वर्ण और combining mark दो गिने जाते हैं।
क्या duplicate हटते हैं?
हाँ। बिल्कुल समान पाठ पहली उपस्थिति के क्रम में एक बार आता है। Case और accent अलग माने जाते हैं।
परिणाम किस क्रम में हैं?
लंबे शब्द पहले आते हैं; समान लंबाई पर पहली matching उपस्थिति का क्रम रहता है।