टेक्स्ट

Sort & Dedupe Lines

टेक्स्ट की लाइनों को अल्फ़ाबेटिकल क्रम में सॉर्ट करें, डुप्लिकेट्स, खाली लाइनें और अतिरिक्त स्पेस हटाएं।

This tool sorts a list of lines alphabetically and removes duplicates and blank lines — a routine cleanup that's slow and error-prone to do by hand.

How to use it

Common uses

Things to keep in mind

Plain alphabetical sorting puts "file10" before "file2", since it compares strings character by character — natural sort is needed for the expected order with numbers.

Duplicate removal is case-sensitive by default — "Text" and "text" count as different lines unless the text is normalized to one case first.

इस टूल के बारे में लेख: लाइन सॉर्टिंग: वर्णानुक्रम और संख्यात्मक क्रम में अंतर क्यों है

अक्सर पूछे जाने वाले प्रश्न

केस-संवेदनशील और केस-असंवेदनशील सॉर्टिंग में क्या अंतर है?

"केस-असंवेदनशील" बंद होने पर, बड़े और छोटे अक्षर कैरेक्टर कोड के अनुसार अलग-अलग सॉर्ट होते हैं; चालू होने पर, यह केस को नज़रअंदाज़ करते हुए लाइनों की तुलना करता है, जिससे "Apple" और "apple" पास आ जाते हैं।

डुप्लिकेट्स, खाली लाइनें, और व्हाइटस्पेस कैसे संभाले जाते हैं?

दो समान लाइनें (चुने गए केस विकल्प के अनुसार) डुप्लिकेट मानी जाती हैं और केवल पहली रखी जाती है; "व्हाइटस्पेस ट्रिम करें" सॉर्ट करने से पहले शुरुआती और अंतिम स्पेस हटाता है, और "खाली लाइनें हटाएं" बिना दिखाई देने वाले कैरेक्टर वाली लाइनों को समाप्त करता है।

क्या मेरी टेक्स्ट लाइनें सर्वर पर भेजी जाती हैं?

नहीं, सॉर्टिंग और डिडुप्लिकेशन पूरी तरह आपके ब्राउज़र में JavaScript में होते हैं — कोई डेटा कहीं और नहीं भेजा जाता।

अल्फ़ाबेटिकल सॉर्टिंग में "10", "9" से पहले क्यों आता है?

अल्फ़ाबेटिकल (लेक्सिकोग्राफ़िक) सॉर्टिंग स्ट्रिंग की तुलना कैरेक्टर-दर-कैरेक्टर टेक्स्ट की तरह करती है, संख्या की तरह नहीं: "1" लेक्सिकोग्राफ़िक रूप से "9" से छोटा है, इसलिए "10", "9" से पहले आ जाता है। संख्यात्मक क्रम पाने के लिए स्ट्रिंग को पहले संख्या के रूप में पार्स करना ज़रूरी है।

क्या प्राकृतिक क्रम (natural sort) में सॉर्ट किया जा सकता है?

प्राकृतिक सॉर्टिंग किसी स्ट्रिंग के भीतर अंकों की सीक्वेंस को संख्या के रूप में पहचानती है, जबकि बाकी हिस्से की तुलना टेक्स्ट की तरह करती है — इसी वजह से "file2.txt", "file10.txt" से पहले आता है, जो टेक्स्ट प्रीफ़िक्स वाले फ़ाइल नामों या वर्शन के लिए सुविधाजनक है।

लेख: टेक्स्ट

camelCase, snake_case, kebab-case: कब कौन-सी शैली इस्तेमाल करें

camelCase, snake_case और kebab-case क्यों मौजूद हैं, और हर एक आमतौर पर कहाँ इस्तेमाल होती है।

Text Diff: टेक्स्ट के अंतर ढूँढने का एल्गोरिदम कैसे काम करता है

diff एल्गोरिदम टेक्स्ट के दो संस्करणों के बीच न्यूनतम परिवर्तन सेट कैसे ढूँढता है।

रेगुलर एक्सप्रेशन: बुनियादी बातें और लालची मिलान का जाल

रेगुलर एक्सप्रेशन में लालची और आलसी मिलान में अंतर, और व्यवहार में यह क्यों मायने रखता है।

स्ट्रिंग एस्केपिंग: JS, JSON, शेल और रेगेक्स में अलग-अलग नियम क्यों

हर जगह काम करने वाला कोई एक एस्केपिंग नियम क्यों नहीं है — JS, JSON, शेल और रेगेक्स सबके अपने नियम हैं।

CRLF और LF: लाइन एंडिंग अब भी समस्याएँ क्यों पैदा करती हैं

CRLF और LF में अंतर कहाँ से आया, और git व स्क्रिप्ट के साथ यह आज भी समस्याएँ क्यों पैदा करता है।

कैरेक्टर और शब्द गिनना: यूनिकोड इसे जटिल क्यों बनाता है

यूनिकोड में विज़ुअली एक इमोजी कई कोड पॉइंट से क्यों बन सकता है।

Lorem Ipsum: यह प्लेसहोल्डर टेक्स्ट कहाँ से आया और इसका कोई मतलब क्यों नहीं

Lorem Ipsum टेक्स्ट वास्तव में कहाँ से आया, और असली टेक्स्ट की जगह अर्थहीन टेक्स्ट क्यों इस्तेमाल होता है।

Slugify: टाइटल एक वैध URL में कैसे बदलता है

एक आर्टिकल टाइटल हाइफ़न वाले साफ़, पढ़ने योग्य URL में कैसे बदलता है।

Markdown: यह डॉक्यूमेंटेशन का मानक क्यों बना

HTML के विपरीत, Markdown कच्चे रूप में भी पढ़ने योग्य क्यों रहता है।

अदृश्य स्पेस: विज़ुअली एक जैसे टेक्स्ट की तुलना क्यों फेल हो जाती है

एक अदृश्य स्पेस विज़ुअली एक जैसे दो टेक्स्ट की तुलना कैसे फेल कर सकता है।

टेक्स्ट रिवर्स करना: इमोजी के साथ यह क्यों टूट जाता है

नैव टेक्स्ट रिवर्सल कई कोड पॉइंट से बने इमोजी को क्यों तोड़ देता है।

टेक्स्ट फ्रीक्वेंसी एनालिसिस: वर्ड क्लाउड से लेकर सिफर तोड़ने तक

अक्षर फ्रीक्वेंसी एनालिसिस ने ऐतिहासिक रूप से सरल सब्स्टिट्यूशन सिफर तोड़ने में कैसे मदद की।