यूनीक वर्ड एक्सट्रैक्टर
किसी टेक्स्ट से हर अलग शब्द को वर्णानुक्रमिक सूची के रूप में निकालें — शब्दावली सूचियों, कीवर्ड विश्लेषण, और भाषा अध्ययन के लिए एकदम सही। छोटे शब्द फ़िल्टर करें, घटना गिनती दिखाएँ, और परिणाम को पंक्तियों या अल्पविराम से अलग करके कॉपी करें।
विकल्प
तुर्की एकमात्र भाषा है जो केस बदलते समय अक्षर i को अलग तरह से संभालती है: İ, i में लोअरकेस होता है, और i, İ में अपरकेस होता है।
अक्सर पूछे जाने वाले प्रश्न
- यूनीक वर्ड एक्सट्रैक्टर क्या करता है?
- यह आपके टेक्स्ट को स्कैन करता है, हर अलग शब्द इकट्ठा करता है, सूची को वर्णानुक्रम में लगाता है, और इसे कुल व यूनीक शब्द गिनती के साथ दिखाता है। आप छोटे शब्दों को फ़िल्टर कर सकते हैं, दिखा सकते हैं कि हर शब्द कितनी बार आता है, और परिणाम को प्रति पंक्ति एक शब्द या अल्पविराम से अलग करके कॉपी कर सकते हैं।
- केस-इनसेंसिटिव विकल्प क्या करता है?
- जब चालू हो (डिफ़ॉल्ट), "The" और "the" एक शब्द के रूप में गिने जाते हैं और सूची लोअरकेस हो जाती है। अलग-अलग कैपिटलाइज़ किए गए रूपों को अलग शब्द मानने और उनका मूल कैपिटलाइज़ेशन सुरक्षित रखने के लिए इसे बंद करें।
- न्यूनतम लंबाई फ़िल्टर किसके लिए है?
- यह चुनी गई अक्षर संख्या से छोटे शब्दों को छिपाता है। इसे 4 या 5 पर सेट करने से "the", "a", और "of" जैसे सामान्य छोटे शब्द फ़िल्टर हो जाते हैं, जो शब्दावली सूचियों को कहीं अधिक उपयोगी बनाता है।
- अपॉस्ट्रोफ़ी और हाइफ़न वाले शब्दों को कैसे संभाला जाता है?
- don't जैसे संकुचन और well-known जैसे हाइफ़नेटेड शब्दों को एकल शब्दों के रूप में रखा जाता है। आस-पास के विराम चिह्न — पूर्ण विराम, अल्पविराम, उद्धरण, कोष्ठक — हटा दिए जाते हैं।
- क्या मेरा टेक्स्ट किसी सर्वर पर भेजा जाता है?
- नहीं। निष्कर्षण पूरी तरह आपके ब्राउज़र में होता है — आपका टेक्स्ट कभी अपलोड, संग्रहीत, या साझा नहीं किया जाता।