शब्द आवृत्ति काउंटर
किसी भी टेक्स्ट में शब्द आवृत्ति का विश्लेषण करें। रैंक, गणना, प्रतिशत, bigrams, trigrams, hapax legomena और एक दृश्य वर्ड क्लाउड प्राप्त करें। मुफ़्त और निजी।
अपडेट किया गया
Input Text
Options
Analysis Results
Enter some text above to see word frequency analysis.
अक्सर पूछे जाने वाले प्रश्न
वर्ड फ़्रीक्वेंसी काउंटर क्या है?
यह टेक्स्ट का विश्लेषण करता है और बताता है कि प्रत्येक शब्द कितनी बार आता है और उसका प्रतिशत हिस्सा क्या है। यह SEO कीवर्ड घनत्व, लेखन शैली की समीक्षा और भाषाई शोध के लिए उपयोगी है।
stop words क्या होते हैं?
the, a, and, is जैसे सामान्य फ़ंक्शन शब्द जो बार-बार आते हैं पर बहुत कम अर्थ रखते हैं। इन्हें हटाने से वे सामग्री-शब्द उभरकर आते हैं जो आपके टेक्स्ट की विशेषता बताते हैं।
hapax legomena, bigrams, trigrams क्या होते हैं?
Hapax legomena = ठीक एक बार आने वाले शब्द। Bigrams/trigrams = दो/तीन शब्दों के अनुक्रम। इन्हें गिनने से एकल-शब्द आवृत्ति से परे सामान्य वाक्यांश और सहप्रयोग सामने आते हैं।
क्या Word Frequency Counter इस्तेमाल करना मुफ़्त है?
हाँ, Word Frequency Counter 100% मुफ़्त है, बिना किसी पंजीकरण, बिना किसी छिपे शुल्क और बिना किसी उपयोग सीमा के। सारी प्रोसेसिंग आपके ब्राउज़र में स्थानीय रूप से होती है, जिससे पूर्ण गोपनीयता सुनिश्चित होती है।
क्या इस टूल के साथ मेरा डेटा सुरक्षित है?
बिल्कुल। Word Frequency Counter सब कुछ आपके ब्राउज़र में क्लाइंट-साइड प्रोसेस करता है। कोई भी डेटा किसी सर्वर पर अपलोड या संग्रहीत नहीं होता। आपकी सामग्री हर समय आपके डिवाइस पर निजी रहती है।
क्या Word Frequency Counter मोबाइल डिवाइस पर काम करता है?
हाँ, Word Frequency Counter पूरी तरह रिस्पॉन्सिव है और स्मार्टफ़ोन व टैबलेट पर काम करता है। आप इसे आधुनिक वेब ब्राउज़र वाले किसी भी डिवाइस पर इस्तेमाल कर सकते हैं -- किसी ऐप डाउनलोड की ज़रूरत नहीं।
क्या इस टूल को इस्तेमाल करने के लिए मुझे खाता बनाना होगा?
किसी खाते या पंजीकरण की ज़रूरत नहीं है। बस अपने ब्राउज़र में Word Frequency Counter खोलें और तुरंत इस्तेमाल शुरू करें। कोई साइन-अप दीवार या उपयोग प्रतिबंध नहीं है।
क्या मैं बड़ी मात्रा में टेक्स्ट प्रोसेस कर सकता हूँ?
हाँ, Word Frequency Counter किसी भी लंबाई के टेक्स्ट को तेज़, रियल-टाइम प्रोसेसिंग के साथ संभालता है। चूँकि सब कुछ आपके ब्राउज़र में चलता है, प्रदर्शन आपके डिवाइस पर निर्भर करता है, पर अधिकांश मामलों में यह अच्छी तरह काम करता है।
मैं Word Frequency Counter का इस्तेमाल कैसे करूँ?
बस दिए गए फ़ील्ड में अपना इनपुट डालें, अपनी पसंद के अनुसार सेटिंग्स समायोजित करें, और टूल इसे तुरंत प्रोसेस कर देगा। इसके बाद आप परिणाम को क्लिपबोर्ड पर कॉपी कर सकते हैं या डाउनलोड कर सकते हैं।
कौन-से ब्राउज़र समर्थित हैं?
Word Frequency Counter Chrome, Firefox, Safari, Edge और Opera सहित सभी आधुनिक ब्राउज़रों में काम करता है। सर्वोत्तम अनुभव के लिए अपने पसंदीदा ब्राउज़र का नवीनतम संस्करण इस्तेमाल करें।
कीवर्ड डेंसिटी के लिए कितना प्रतिशत सही माना जाता है, और क्या कोई ऐसी संख्या है जिस पर Google पेनल्टी देता है?
ऐसी कोई आधिकारिक डेंसिटी सीमा नहीं है जिसे Google इनाम दे या पेनल्टी दे; आधुनिक रैंकिंग किसी लक्ष्य प्रतिशत पर नहीं बल्कि प्रासंगिकता (relevance) और संदर्भ पर निर्भर करती है। एक व्यावहारिक गाइडलाइन के तौर पर, कंटेंट राइटर्स एक अंक की निचली रेंज को स्वाभाविक मानते हैं, जबकि किसी एक वाक्यांश का लगभग 4-5% या उससे ज़्यादा दिखना दोबारा जांचने लायक है — यह अक्सर बातचीत जैसे लहजे के बजाय ठूंसा हुआ महसूस होता है। सही संख्या टेक्स्ट की लंबाई पर निर्भर करती है: 300 शब्दों के पेज में एक दोहराया गया शब्द प्रतिशत को जल्दी बढ़ा देता है, जबकि 2,000 शब्दों के लेख में वही शब्द मुश्किल से नज़र आता है। किसी आंकड़े के पीछे भागने के बजाय, डेंसिटी को संदिग्ध हिस्सों को दोबारा पढ़ने के संकेत के रूप में इस्तेमाल करें। यह काउंटर हर शब्द की सटीक गिनती और प्रतिशत हिस्सा दिखाता है, और इसके बाइग्राम व ट्राइग्राम व्यू पुष्टि करते हैं कि आपका टारगेट वाक्यांश विविध, सही संदर्भों में आ रहा है या नहीं। यह देखने के लिए कि कोई शब्द कहां हावी हो रहा है, अपना ड्राफ्ट ऊपर पेस्ट करें।
मैं यह कैसे पता करूं कि मैं अपने लेखन में किन शब्दों का ज़्यादा इस्तेमाल कर रहा हूं?
क्रच वर्ड्स — जैसे just, really, actually, very, और that जैसे पसंदीदा शब्द — बिना ध्यान दिए ड्राफ्ट में घुस जाते हैं, और इन्हें पकड़ने का सबसे तेज़ तरीका है फ्रीक्वेंसी काउंट। अपना टेक्स्ट पेस्ट करें और परिणामों को गिनती के अनुसार अवरोही (descending) क्रम में सॉर्ट करें, ताकि सबसे ज़्यादा दोहराए गए शब्द सबसे ऊपर आ जाएं। चूंकि फिलर वर्ड्स अक्सर फंक्शन वर्ड्स होते हैं, अगर आप विशेष रूप से देखना चाहते हैं कि the, and, या that कितनी बार आते हैं, तो Exclude Stop Words को बंद कर दें; कंटेंट शब्दों पर ध्यान केंद्रित करने के लिए इसे चालू रखें। लिस्ट के ऊपरी हिस्से को देखें कि क्या कुछ आपको चौंकाता है, फिर उस शब्द को अपने दस्तावेज़ में खोजें और उसके उपयोग में बदलाव करें या हटाएं। प्रतिशत कॉलम बताता है कि हर आदत कितनी जगह घेरती है। यह टूल हर अलग शब्द को उसकी गिनती और हिस्सेदारी के साथ रैंक करता है, जिससे ज़्यादा इस्तेमाल किए गए शब्द सेकंडों में स्पष्ट हो जाते हैं — शुरू करने के लिए ऊपर अपना ड्राफ्ट पेस्ट करें।
टाइप-टोकन रेशियो या लेक्सिकल डाइवर्सिटी क्या है, और अच्छा माना जाने वाला आंकड़ा क्या है?
लेक्सिकल डाइवर्सिटी यह मापती है कि आपकी शब्दावली कितनी विविध है, जिसकी गणना अद्वितीय शब्दों को कुल शब्दों से भाग देकर की जाती है — यही टाइप-टोकन रेशियो है। यह टूल इसे डाइवर्सिटी रेशियो प्रतिशत के रूप में दिखाता है: ज़्यादा आंकड़ा ज़्यादा अलग-अलग शब्दों और कम दोहराव का संकेत देता है, जबकि कम आंकड़ा बताता है कि आप एक ही शब्दों पर बार-बार निर्भर हो रहे हैं। इसके लिए कोई सार्वभौमिक पास-मार्क नहीं है, क्योंकि टेक्स्ट लंबा होने पर यह अनुपात स्वाभाविक रूप से घटता है; एक ही शैली में लिखा 100 शब्दों का नोट लगभग हमेशा 5,000 शब्दों की रिपोर्ट से ज़्यादा डाइवर्सिटी दिखाएगा। इसलिए यह समान लंबाई के दो ड्राफ्ट की तुलना करने में, या यह ट्रैक करने में सबसे उपयोगी है कि किसी संपादन ने आपकी शब्दावली को कसा है या पतला किया है। हैपैक्स लेगोमेना गिनती — यानी ठीक एक बार इस्तेमाल हुए शब्द — समृद्धि का एक सहायक संकेत है। अपनी डाइवर्सिटी रेशियो, अद्वितीय शब्द गिनती, और हैपैक्स टोटल को साथ-साथ देखने के लिए ऊपर अपना टेक्स्ट पेस्ट करें।
क्या मुझे गिनती को केस सेंसिटिव बनाना चाहिए, और यह कब मायने रखता है?
डिफ़ॉल्ट रूप से यह काउंटर केस इनसेंसिटिव होता है, इसलिए Apple, apple, और APPLE को एक ही एंट्री में मिला दिया जाता है — आमतौर पर यही सही होता है, क्योंकि ये एक ही शब्द हैं और इन्हें मिलाने से एक सटीक कुल संख्या मिलती है। केस सेंसिटिविटी तब चालू करें जब कैपिटलाइज़ेशन कोई ऐसा अर्थ रखता हो जिसे आपको बनाए रखना है: जैसे ब्रांड Apple को फल apple से अलग करना, किसी संज्ञा को सामान्य शब्द से अलग करना, या यह जांचना कि कोई हेडिंग स्टाइल शब्दों को लगातार कैपिटलाइज़ करती है या नहीं। ध्यान रखें कि केस सेंसिटिविटी चालू होने पर, किसी वाक्य की शुरुआत वाला शब्द वाक्य के बीच में आने वाले उसी शब्द से अलग गिना जाता है, जिससे आपकी लिस्ट बंट सकती है और दिखने वाली फ्रीक्वेंसी कम हो सकती है। ज़्यादातर SEO और एडिटिंग काम के लिए, साफ़ और सटीक तस्वीर पाने हेतु इसे बंद ही रखें। बिना टेक्स्ट दोबारा पेस्ट किए तुरंत दोनों गिनतियों की तुलना करने के लिए ऊपर दिए टॉगल का इस्तेमाल करें।
मैं वर्ड फ्रीक्वेंसी के नतीजों को स्प्रेडशीट में कैसे एक्सपोर्ट कर सकता हूं?
आपका टेक्स्ट विश्लेषित हो जाने के बाद, आप डेटा को तीन तरीकों से कहीं और ले जा सकते हैं। Copy पर क्लिक करके रैंक की गई लिस्ट को अपने क्लिपबोर्ड पर लाएं ताकि उसे किसी दस्तावेज़ में पेस्ट किया जा सके, या CSV डाउनलोड करें ताकि चार कॉलम — रैंक, शब्द, गिनती, और प्रतिशत — वाली एक फ़ाइल मिले, जो Excel, Google Sheets, या Numbers में सीधे खुल जाती है, सॉर्टिंग, चार्टिंग, या आगे के विश्लेषण के लिए। डेवलपर्स और ज़्यादा जटिल वर्कफ़्लो के लिए, इसके बजाय JSON डाउनलोड करें: यह आपके चुने गए विकल्पों, सारांश मेट्रिक्स, और पूरी बाइग्राम व ट्राइग्राम लिस्ट को एक ही स्ट्रक्चर्ड फ़ाइल में पैक कर देता है। यह सब आपके ब्राउज़र में ही जनरेट होता है, इसलिए बड़े टेक्स्ट भी बिना कुछ अपलोड किए तुरंत एक्सपोर्ट हो जाते हैं। एक्सपोर्ट करने से पहले अपने फ़िल्टर — स्टॉप वर्ड्स, न्यूनतम लंबाई, अधिकतम परिणाम — एडजस्ट कर लें ताकि फ़ाइल ठीक वही व्यू दर्शाए जो आप चाहते हैं। ऊपर अपना टेक्स्ट पेस्ट करें, फिर अपने अगले कदम के हिसाब से फ़ॉर्मेट चुनें।
संबंधित टूल
मुफ़्त ऑनलाइन वर्ड काउंटर
शब्द, अक्षर, वाक्य, अनुच्छेद और पढ़ने का समय तुरंत गिनें। मुफ़्त ऑनलाइन वर्ड काउंटर टूल। पूरी तरह आपके ब्राउज़र में काम करता है, बिना किसी साइन-अप के।
मुफ़्त ऑनलाइन टेक्स्ट केस कनवर्टर
टेक्स्ट को अपरकेस, लोअरकेस, टाइटल केस या वाक्य केस में बदलें। मुफ़्त ऑनलाइन केस कनवर्टर। पूरी तरह आपके ब्राउज़र में काम करता है, बिना किसी साइन-अप के।
मुफ़्त Lorem Ipsum जनरेटर
डिज़ाइन और डेवलपमेंट प्रोजेक्ट्स के लिए Lorem Ipsum प्लेसहोल्डर टेक्स्ट बनाएं। मुफ़्त, तेज़ और पूरी तरह आपके ब्राउज़र में काम करता है, बिना किसी साइन-अप के।
मुफ़्त डुप्लिकेट लाइन रिमूवर
अपने टेक्स्ट से डुप्लिकेट लाइनें हटाएं, क्रम को बनाए रखते हुए। मुफ़्त ऑनलाइन टूल। पूरी तरह आपके ब्राउज़र में काम करता है, बिना किसी साइन-अप के।
Word Frequency Counter के बारे में
Word Frequency Counter किसी भी टेक्स्ट का विश्लेषण करके बताता है कि हर शब्द कितनी बार आता है, और उन्हें सबसे ज़्यादा से सबसे कम इस्तेमाल होने वाले क्रम में रैंक करता है — साथ में सटीक गिनती (count) और कुल टेक्स्ट में उस शब्द का प्रतिशत हिस्सा भी देता है। कोई लेख, ट्रांसक्रिप्ट, निबंध या प्रोडक्ट पेज पेस्ट कीजिए और यह तुरंत उन शब्दों को सामने ला देता है जो असल में आपका मैसेज बयां करते हैं — सिर्फ जोड़ने वाले शब्दों को नहीं। यह टूल उन SEO राइटर्स के लिए बनाया गया है जो कीवर्ड डेंसिटी चेक करते हैं, उन एडिटर्स के लिए जो बार-बार दोहराए गए शब्द ढूंढते हैं, उन छात्रों और शोधकर्ताओं के लिए जो बारीकी से पढ़ाई (close reading) करते हैं, और हर उस व्यक्ति के लिए जो यह जानना चाहता है कि किसी लेख की भाषा-शैली कैसी है।
सारा कैलकुलेशन आपके ब्राउज़र में ही होता है। आपके द्वारा पेस्ट किया गया टेक्स्ट कभी सर्वर पर अपलोड नहीं होता, इसलिए अप्रकाशित ड्राफ्ट, क्लाइंट कॉपी और निजी नोट्स आपकी अपनी डिवाइस पर ही सुरक्षित रहते हैं। न कोई साइन-अप चाहिए, न कोई लंबाई की सीमा, और न कुछ इंस्टॉल करने की ज़रूरत।
एनालाइज़र क्या-क्या मापता है
एक सामान्य फ्रीक्वेंसी लिस्ट के अलावा, यह टूल चार सारांश मेट्रिक्स भी देता है जो पूरी शब्दावली की तस्वीर पेश करते हैं:
- कुल शब्द (Total words) — आपके फ़िल्टर लागू होने के बाद गिने गए टोकन की संख्या।
- अद्वितीय शब्द (Unique words) — कितने अलग-अलग शब्द कम से कम एक बार आते हैं।
- विविधता अनुपात (Diversity ratio) — अद्वितीय शब्दों को कुल शब्दों से भाग देकर मिलने वाला प्रतिशत। यह जितना ज़्यादा होगा, शब्दावली उतनी ही विविध होगी; ज़्यादा दोहराव इसे नीचे खींच देता है।
- हैपैक्स लेगोमेना (Hapax legomena) — ऐसे शब्दों की गिनती जो ठीक एक ही बार आते हैं। यह शब्द ग्रीक भाषा से आया है जिसका मतलब है "सिर्फ एक बार कहा गया", और इनका ज़्यादा अनुपात समृद्ध, गैर-दोहरावदार गद्य का एक क्लासिक संकेत माना जाता है।
रिज़ल्ट टेबल में हर शब्द के साथ उसकी रैंक, कच्ची गिनती और प्रतिशत दिया जाता है, ताकि आप एक नज़र में देख सकें कि कहीं कोई एक शब्द पूरे पेज पर हावी तो नहीं है।
गिनती को ट्यून करना: स्टॉप वर्ड्स, केस और n-grams
कच्ची फ्रीक्वेंसी लिस्ट में अक्सर the, and, of जैसे फंक्शन वर्ड्स ऊपर रहते हैं। इससे बचने के लिए स्टॉप वर्ड्स हटाएं (Exclude Stop Words) डिफ़ॉल्ट रूप से ऑन रहता है, जो करीब 140 आम अंग्रेज़ी फंक्शन वर्ड्स को फ़िल्टर कर देता है ताकि असल मायने रखने वाले कंटेंट शब्द ऊपर आ सकें। जब आपको बिना फ़िल्टर की गई पूरी डिस्ट्रिब्यूशन देखनी हो तो इसे बंद कर दें। आप एक न्यूनतम शब्द लंबाई (minimum word length) भी सेट कर सकते हैं ताकि छोटे टोकन हट जाएं, अधिकतम परिणाम (maximum results) की सीमा तय कर सकते हैं, केस सेंसिटिविटी टॉगल कर सकते हैं (ताकि Apple और apple अलग-अलग गिने जाएं), और गिनती, वर्णानुक्रम या शब्द की लंबाई के हिसाब से सॉर्ट कर सकते हैं।
अकेले शब्द पूरी कहानी नहीं बताते, इसलिए यह टूल बाइग्राम (bigrams) और ट्राइग्राम (trigrams) भी निकालता है — यानी आपके टेक्स्ट में सबसे ज़्यादा दोहराए गए दो और तीन शब्दों के क्रम। ये कोलोकेशन और बार-बार आने वाले वाक्यांशों को उजागर करते हैं, जिन्हें अकेले शब्दों की गिनती पकड़ नहीं पाती — और यही वह चीज़ है जो यह जांचने में मायने रखती है कि कोई मुख्य वाक्यांश कितनी स्वाभाविकता से पढ़ा जाता है। एक वर्ड क्लाउड (word cloud) व्यू टॉप शब्दों को उनकी फ्रीक्वेंसी के हिसाब से बड़ा-छोटा दिखाकर एक झटपट विज़ुअल समझ देता है।
SEO और एडिटिंग के लिए वर्ड फ्रीक्वेंसी क्यों मायने रखती है
सर्च के लिहाज़ से, फ्रीक्वेंसी कीवर्ड डेंसिटी का एक प्रॉक्सी है — यानी आपके कंटेंट में किसी शब्द का कितना हिस्सा है। Google किसी जादुई संख्या को इनाम नहीं देता, लेकिन अगर कोई वाक्यांश 4-5% या उससे ज़्यादा दिखे, तो यह एक उपयोगी संकेत है कि कॉपी स्वाभाविक की बजाय ठूंसी हुई लग सकती है। बाइग्राम और ट्राइग्राम व्यू यह पुष्टि करने में मदद करते हैं कि आपका टारगेट वाक्यांश सही और विविध संदर्भों में आता है, न कि सिर्फ जस-का-तस दोहराया जा रहा है।
एडिटिंग के लिए, यह लिस्ट एक तेज़ "क्रच-वर्ड" डिटेक्टर की तरह काम करती है। लेखक अक्सर बिना ध्यान दिए अपने पसंदीदा शब्दों — जैसे just, really, actually, very — पर निर्भर हो जाते हैं, और एक फ्रीक्वेंसी काउंट यह आदत सेकंडों में सामने ला देता है। विविधता अनुपात और हैपैक्स गिनती दो ड्राफ्ट की तुलना करते समय शब्दावली की समृद्धि का एक मोटा, वस्तुनिष्ठ अंदाज़ा देते हैं, और शोधकर्ता इसी डेटा का इस्तेमाल स्टाइलोमेट्री और कंटेंट एनालिसिस के लिए करते हैं।
अपने नतीजे एक्सपोर्ट करना
जब आपको यह डेटा कहीं और चाहिए हो, तो रैंक की गई लिस्ट को क्लिपबोर्ड पर कॉपी करें, या इसे CSV (रैंक, शब्द, गिनती, प्रतिशत) के रूप में डाउनलोड करें ताकि स्प्रेडशीट में इस्तेमाल हो सके, या JSON के रूप में डाउनलोड करें जिसमें आपके चुने गए विकल्प, सारांश मेट्रिक्स, और पूरी बाइग्राम व ट्राइग्राम लिस्ट एक साथ पैक होती है। एक सैंपल बटन उदाहरण टेक्स्ट लोड करता है ताकि आप पहले हर व्यू को भरा हुआ देख सकें।
अपना टेक्स्ट ऊपर पेस्ट करें ताकि पूरा फ्रीक्वेंसी ब्रेकडाउन बन सके, फिर फ़िल्टर्स को तब तक एडजस्ट करें जब तक तस्वीर वैसी न दिखे जैसी आप समझना चाहते हैं।