शब्द गणना काउंटर

अपना टेक्स्ट नीचे पेस्ट करें या टाइप करें — शब्द, वर्ण, वाक्य, अनुच्छेद और पढ़ने का समय लिखते ही लाइव अपडेट होते हैं। पूरी तरह आपके ब्राउज़र में चलता है; कुछ भी अपलोड नहीं होता।

0 शब्द
0 वर्ण
0 वर्ण (बिना स्पेस)
0 वाक्य
0 अनुच्छेद
0 सेकंड पढ़ने का समय

प्लेटफ़ॉर्म सीमाएँ (वर्ण)

  • X (ट्विटर) 0 / 280
  • Instagram कैप्शन 0 / 2200
  • LinkedIn पोस्ट 0 / 3000
  • मेटा डिस्क्रिप्शन 0 / 160
  • Facebook पोस्ट 0 / 63206

शब्द गणना काउंटर का उपयोग कैसे करें

अपनी सामग्री बॉक्स में टाइप करें या पेस्ट करें। हर आँकड़ा बिना किसी बटन दबाए तुरंत अपडेट होता है। जैसे-जैसे आपकी वर्ण गणना किसी प्लेटफ़ॉर्म की सीमा के पास पहुँचती है, प्लेटफ़ॉर्म-सीमा बार भरते जाते हैं — 75% से नीचे हरा, 75–90% पर एम्बर, और 90% से ऊपर लाल।

क्या गिना जाता है

  • शब्द — स्पेस, टैब या नई पंक्ति से अलग किए गए बिना-रिक्त वर्णों के क्रम। संख्याएँ और हाइफ़न वाले शब्द — हर एक को एक शब्द गिना जाता है।
  • वर्ण (स्पेस सहित) — स्पेस और विराम-चिह्न सहित हर यूनिकोड कोडपॉइंट। अधिकांश सोशल प्लेटफ़ॉर्म अपनी वर्ण-सीमा के लिए यही संख्या इस्तेमाल करते हैं।
  • वर्ण (बिना स्पेस) — सभी रिक्त जगह को छोड़कर कोडपॉइंट। SEO वर्ण-बजट और शैक्षणिक वर्ण-लक्ष्यों के लिए उपयोगी।
  • वाक्य — ऐसे टेक्स्ट के हिस्से जो ". ! ?" पर समाप्त होते हैं और उसके बाद स्पेस या इनपुट का अंत होता है।
  • अनुच्छेद — एक या अधिक खाली पंक्तियों से अलग किए गए टेक्स्ट के खंड।
  • पढ़ने का समय — शब्द गणना ÷ 200 शब्द प्रति मिनट (एक वयस्क की औसत वेब-पठन गति)।

प्लेटफ़ॉर्म वर्ण-सीमाएँ

प्लेटफ़ॉर्म / संदर्भ वर्ण सीमा टिप्पणियाँ
X (ट्विटर)280URL लंबाई चाहे जो हो, 23 वर्ण गिने जाते हैं।
Instagram कैप्शन2,200"more" के बिना केवल पहले 125 वर्ण दिखते हैं।
LinkedIn पोस्ट3,000"see more" से पहले पहले 210 वर्ण दिखते हैं।
मेटा डिस्क्रिप्शन~160Google ~160 वर्ण पर काट सकता है; 120–155 का लक्ष्य रखें।
Facebook पोस्ट63,206लंबी पोस्ट सिमट जाती हैं; आदर्श लंबाई 500 वर्ण से कम है।

आख़िर एक "शब्द" क्या माना जाता है?

वेब पर लगभग हर शब्द काउंटर — यह भी शामिल — शब्द को स्पेस, टैब या लाइन ब्रेक से घिरे बिना-रिक्त वर्णों के क्रम के रूप में परिभाषित करता है। इसे व्हाइटस्पेस टोकनाइज़ेशन कहते हैं, और अंग्रेज़ी तथा अन्य स्पेस-आधारित भाषाओं के लिए यह उससे मेल खाता है जो लोग सहज रूप से "शब्द" से समझते हैं। इसके कुछ अपवाद ज़रूर हैं: well-being जैसा हाइफ़न वाला संयुक्त शब्द, don't जैसा संक्षिप्त रूप, कोई URL, कोई ईमेल पता और 3.14 जैसी संख्या — हर एक को एक ही टोकन गिना जाता है, क्योंकि इनमें से किसी में भी भीतर कोई स्पेस नहीं होता।

उन भाषाओं के लिए व्हाइटस्पेस टोकनाइज़ेशन पूरी तरह विफल हो जाता है जो शब्दों के बीच स्पेस नहीं रखतीं। चीनी, जापानी और थाई — साथ ही ख्मेर, लाओ और बर्मी — वर्णों की सतत श्रृंखला के रूप में लिखी जाती हैं, जहाँ शब्द-सीमाएँ पाठक के अनुमान पर छोड़ दी जाती हैं। एक चालीस-वर्ण वाले चीनी वाक्य में एक ही स्पेस हो सकता है या बिल्कुल नहीं, इसलिए व्हाइटस्पेस-आधारित शब्द गणना उसे एक या दो "शब्द" बता देगी, जो निरर्थक है। उन लिपियों को असली शब्दों में बाँटने के लिए एक शब्दकोश या सांख्यिकीय सेगमेंटर चाहिए, न कि साधारण स्पेस विभाजन। इसी कारण CJK और थाई टेक्स्ट में सार्थक लंबाई-माप वर्ण गणना है, और प्लेटफ़ॉर्म उसी अनुसार समायोजित करते हैं: उदाहरण के लिए Medium चीनी, जापानी और कोरियाई के लिए पढ़ने का समय आँकते समय शब्द-प्रति-मिनट से हटकर लगभग 500 वर्ण प्रति मिनट पर स्विच कर देता है। यदि आप इनमें से किसी भाषा में काम कर रहे हैं, तो इस पेज पर शब्द के आँकड़े के बजाय वर्ण के आँकड़े पर भरोसा करें।

पढ़ने का समय बनाम बोलने का समय: शोध क्या कहता है

यह टूल पढ़ने के समय का अनुमान 200 शब्द प्रति मिनट पर लगाता है, एक जान-बूझकर रखी गई रूढ़िवादी गति जो सरसरी तौर पर पढ़ी जाने वाली वेब कॉपी के लिए उपयुक्त है। सबसे विस्तृत आधुनिक प्रमाण Marc Brysbaert के 2019 के मेटा-विश्लेषण "How many words do we read per minute?" से आता है, जो Journal of Memory and Language में प्रकाशित हुआ और 18,573 प्रतिभागियों वाले 190 अध्ययनों को समेटता है। इसमें पाया गया कि अंग्रेज़ी को मौन रूप से पढ़ते समय वयस्कों की औसत गति नॉन-फ़िक्शन के लिए लगभग 238 शब्द प्रति मिनट और फ़िक्शन के लिए 260 शब्द/मिनट रहती है, और अधिकांश पाठक 175 से 320 शब्द/मिनट के बीच आते हैं। ज़ोर से पढ़ना धीमा होता है — लगभग 183 शब्द/मिनट — क्योंकि बोलने की प्रक्रिया अड़चन बन जाती है। बच्चे, वृद्ध और दूसरी भाषा में पढ़ने वाले लोग इससे भी धीमे होते हैं, इसलिए कोई एक सार्वभौमिक आँकड़ा हमेशा एक अनुमान ही रहेगा।

बोलना मौन-पठन से धीमा होता है क्योंकि मुँह आँख की रफ़्तार नहीं पकड़ पाता। बातचीत की अंग्रेज़ी लगभग 150 शब्द/मिनट पर चलती है; American Speech-Language-Hearing Association का स्पष्ट प्रस्तुति के लिए व्यापक रूप से उद्धृत मानक 130 शब्द/मिनट के करीब है; ऑडियोबुक वाचक और पॉडकास्टर आमतौर पर 150–160 शब्द/मिनट पर रहते हैं; और TED वक्ता औसतन लगभग 163 शब्द/मिनट बोलते हैं। यदि आप कोई स्क्रिप्ट लिख रहे हैं, तो अपनी शब्द गणना को पठन-दर के बजाय अपनी लक्षित बोलने की दर से भाग दें — 130 शब्द/मिनट पर 1,500 शब्दों का भाषण लगभग 11–12 मिनट का होता है, न कि 7.5 मिनट जितना पठन-अनुमान बताएगा।

गतिविधिसामान्य दर (शब्द/मिनट)स्रोत / टिप्पणी
मौन पठन, नॉन-फ़िक्शन~238Brysbaert 2019 मेटा-विश्लेषण
मौन पठन, फ़िक्शन~260Brysbaert 2019 मेटा-विश्लेषण
ज़ोर से पढ़ना~183Brysbaert 2019 मेटा-विश्लेषण
Medium का पढ़ने-समय अनुमान265पहली छवि के लिए अतिरिक्त ~12 सेकंड
बातचीत~150National Center for Voice and Speech
प्रस्तुति / व्याख्यान~130स्पष्टता के लिए ASHA मानक
पॉडकास्ट / ऑडियोबुक150–160समझ खोए बिना ऊर्जा

ये आँकड़े जनसंख्या-औसत हैं, कोई कठोर सीमा नहीं; किसी व्यक्ति की गति सामग्री की कठिनाई, परिचितता और उद्देश्य के साथ बदलती है। किसी भी पढ़ने-समय बैज को — चाहे यहाँ हो या किसी प्रकाशन प्लेटफ़ॉर्म पर — किसी माप के बजाय एक मित्रवत अनुमान समझें।

सोशल पोस्ट से आगे वर्ण-सीमाएँ: SMS, सर्च और विज्ञापन

ऊपर के सीमा-बार बड़े सोशल नेटवर्क को कवर करते हैं, पर कई अन्य संदर्भ अपने-अपने वर्ण-बजट लगाते हैं — और उनमें से कुछ हैरान करने वाले तरीक़े से व्यवहार करते हैं।

टेक्स्ट संदेश क्लासिक जाल हैं। मानक GSM-7 वर्णमाला का उपयोग करने वाला एक SMS 160 वर्ण रखता है; जिस क्षण आप उस वर्णमाला के बाहर का एक भी वर्ण शामिल करते हैं — अधिकांश इमोजी, कई उच्चारण-चिह्न वाले अक्षर, या कोई भी ग़ैर-लैटिन लिपि — पूरा संदेश UCS-2 (16-बिट) एन्कोडिंग में बदल जाता है और सीमा घटकर 70 वर्ण रह जाती है। लंबे संदेश खंडों में बाँटकर वापस जोड़ दिए जाते हैं, जिसमें हर खंड का कुछ हिस्सा एक हेडर पर ख़र्च होता है: जुड़े हुए GSM-7 संदेश प्रति खंड 153 वर्ण और UCS-2 संदेश 67 वर्ण रखते हैं। इसलिए इमोजी से भरा 75-वर्ण का संदेश आपको दो खंडों का पड़ सकता है, जबकि उतनी ही लंबाई का सादा टेक्स्ट एक खंड में आ जाता।

सर्च स्निपेट वर्णों में नहीं, पिक्सल में मापे जाते हैं। Google डेस्कटॉप पर पेज शीर्षक को लगभग 600 पिक्सल चौड़ाई तक दिखाता है — आमतौर पर 50–60 वर्ण — और मेटा डिस्क्रिप्शन को लगभग 920 पिक्सल, यानी करीब 155–158 वर्ण तक (मोबाइल पर 120 के करीब)। चूँकि W और M जैसे चौड़े अक्षर i या l से ज़्यादा पिक्सल खाते हैं, समान वर्ण-लंबाई वाले दो शीर्षक अलग-अलग जगह कट सकते हैं। Google Ads ज़्यादा सख़्त है और वर्ण सीधे गिनता है: प्रत्येक रिस्पॉन्सिव-सर्च-ऐड शीर्षक 30 वर्ण तक सीमित है, प्रत्येक डिस्क्रिप्शन 90 तक, और दोहरी-चौड़ाई वाले CJK वर्ण दो के बराबर गिने जाते हैं।

संदर्भसीमाटिप्पणियाँ
SMS, GSM-7 (एकल)160 वर्णजुड़ने पर प्रति खंड 153
SMS, UCS-2 (एकल)70 वर्णप्रति खंड 67; इमोजी या ग़ैर-लैटिन टेक्स्ट से सक्रिय
SEO पेज शीर्षक~50–60 वर्ण~600 पिक्सल चौड़ाई से मापा जाता है, वर्णों से नहीं
मेटा डिस्क्रिप्शन~155 वर्ण~920 पिक्सल डेस्कटॉप; मोबाइल पर ~120
Google Ads शीर्षक30 वर्णप्रति रिस्पॉन्सिव सर्च ऐड 15 तक
Google Ads डिस्क्रिप्शन90 वर्णप्रति ऐड 4 तक
X / ट्विटर बायो160 वर्णप्रदर्शन नाम 50, यूज़रनेम 15

प्लेटफ़ॉर्म सीमाएँ बिना ज़्यादा चेतावनी के बदलती रहती हैं — X ने 2017 में पोस्ट सीमा 140 से बढ़ाकर 280 की और अब पेड अकाउंट को 25,000 वर्ण तक पोस्ट करने देता है — इसलिए किसी अहम प्रकाशन से पहले हमेशा प्लेटफ़ॉर्म के मौजूदा दस्तावेज़ से पुष्टि करें।

एक इमोजी दो (या अधिक) वर्ण क्यों गिना जा सकता है

यदि आपने कभी किसी फ़ॉर्म में एक इमोजी पेस्ट की और वर्ण काउंटर को दो से बढ़ते देखा, तो आप आधुनिक टेक्स्ट-हैंडलिंग की सबसे गहरी विचित्रताओं में से एक से मिल चुके हैं: "वर्ण" कोई एक चीज़ नहीं है। तीन अलग-अलग इकाइयाँ हैं जो सभी उचित रूप से यह नाम माँग सकती हैं, और वे अक्सर आपस में असहमत रहती हैं।

  • UTF-16 कोड यूनिट — जो JavaScript का string.length असल में लौटाता है। हर यूनिट 16 बिट की होती है और U+FFFF तक के मान संबोधित कर सकती है।
  • यूनिकोड कोड पॉइंट — मानक में तार्किक वर्ण, जो U+0000 से U+10FFFF तक क्रमांकित हैं। U+FFFF से ऊपर की कोई भी चीज़ (अधिकांश इमोजी, कई दुर्लभ लिपियाँ) एक 16-बिट यूनिट में नहीं समाती, इसलिए JavaScript उसे दो कोड यूनिट के सरोगेट पेयर के रूप में संग्रहीत करता है। मुस्कुराता चेहरा U+1F600 जोड़ी 😀 के रूप में संग्रहीत होता है और इसलिए .length 2 बताता है।
  • ग्राफीम क्लस्टर — जिसे एक इंसान एक वर्ण के रूप में देखता है, जिसे Unicode Standard Annex #29 ("Unicode Text Segmentation") परिभाषित करता है। एक ग्राफीम कई कोड पॉइंट से बन सकता है।

इन परतों के बीच का फ़र्क तेज़ी से बढ़ता है। यूनाइटेड किंगडम जैसा राष्ट्रीय झंडा दो रीजनल-इंडिकेटर कोड पॉइंट है (U+1F1EC और U+1F1E7), जो चार UTF-16 कोड यूनिट हैं पर एक ही ग्राफीम। त्वचा-रंग वाला लहराता हाथ मूल इमोजी और एक मॉडिफ़ायर कोड पॉइंट है। परिवार इमोजी कई लोगों को ज़ीरो-विड्थ जॉइनर U+200D से जोड़कर बनाई जाती है — पुरुष-स्त्री-लड़की वाला परिवार पाँच कोड पॉइंट है, और दूसरा बच्चा जोड़ने पर यह सात तक पहुँच जाता है, फिर भी यह एक ही ग्राफीम है जिसे आप एक वर्ण गिनेंगे।

टेक्स्टग्राफीम (मानवीय)कोड पॉइंटJS .length (UTF-16)
café (पूर्व-संयोजित é)444
café (e + संयोजी उच्चारण-चिह्न)455
😀 मुस्कुराता चेहरा112
🇬🇧 UK झंडा124
👨‍👩‍👧 परिवार158

यह काउंटर वर्णों को कोड पॉइंट के हिसाब से गिनता है, जो वही इकाई है जिसे अधिकांश सोशल प्लेटफ़ॉर्म अपनी सीमाओं के लिए इस्तेमाल करते हैं, इसलिए इसके आँकड़े उससे मेल खाते हैं जो X या Instagram स्वीकार करेंगे। यदि इसके बजाय आपको मानव-दृश्य गणना चाहिए, तो आधुनिक ब्राउज़र ग्राफीम-स्तर के साथ Intl.Segmenter प्रदान करते हैं, और किसी स्ट्रिंग को स्प्रेड सिंटैक्स [...text] से चलाना उसे कोड यूनिट के बजाय कोड पॉइंट के हिसाब से पार करता है।

लेखकों के लिए शब्द गणना: पांडुलिपि पृष्ठ और दस्तावेज़ लंबाई

प्रकाशन और शिक्षा-जगत आज भी पृष्ठों में सोचते हैं, और शब्द गणना तथा पृष्ठ गणना के बीच का पुल एक पुरानी परंपरा है। पारंपरिक अनुमान है 12-पॉइंट टाइप और एक-इंच मार्जिन में डबल-स्पेस पृष्ठ प्रति 250 शब्द — एक आँकड़ा जो Courier जैसे मोनोस्पेस्ड टाइपराइटर फ़ॉन्ट से चला आता है। आधुनिक आनुपातिक फ़ॉन्ट उसी भौतिक पृष्ठ पर काफ़ी ज़्यादा समा लेते हैं, इसलिए उन सेटिंग्स पर एक वास्तविक वर्ड-प्रोसेसर दस्तावेज़ प्रति पृष्ठ 300–400 शब्द के करीब पहुँच सकता है; फिर भी संपादक और एजेंट 250-शब्द नियम इस्तेमाल करते रहते हैं क्योंकि यह लंबाई आँकने का एक स्थिर, फ़ॉन्ट-निरपेक्ष तरीक़ा देता है। अधिकांश अमेरिकी और कनाडाई प्रकाशक प्रति पांडुलिपि पृष्ठ 250–300 शब्द का दिशानिर्देश बताते हैं।

किसी रचना की योजना बनाते समय मोटे-मोटे शब्द-गणना मानक जानना उपयोगी होता है, हालाँकि हर आँकड़ा विधा और प्रकाशक के अनुसार बदलता है:

  • एक मानक डबल-स्पेस पांडुलिपि पृष्ठ ≈ 250 शब्द।
  • एक सामान्य 500-शब्द ब्लॉग पोस्ट ≈ 2 पांडुलिपि पृष्ठ, लगभग ढाई मिनट का पठन।
  • कॉलेज निबंध अब आमतौर पर पृष्ठों के बजाय शब्दों में तय होते हैं (उदाहरण के लिए 1,500–2,500)।
  • फ़्लैश फ़िक्शन ~1,000 शब्दों से कम होती है; एक लघुकथा मोटे तौर पर 1,000–7,500 शब्दों की होती है।
  • अधिकांश वयस्क उपन्यास 70,000 से 100,000 शब्दों के बीच होते हैं, जिनमें 80,000–90,000 एक आम लक्ष्य है।

चूँकि ये दायरे नियम नहीं बल्कि परंपराएँ हैं, किसी विशिष्ट लक्ष्य तक पहुँचने के लिए ऊपर की लाइव गणना का उपयोग करें और किसी भी पृष्ठ-अनुमान को अनुमानित ही समझें।

कीवर्ड घनत्व, कीवर्ड स्टफ़िंग और पठनीयता

सर्च के लिए अनुकूलन करने वाले लेखक अक्सर पूछते हैं कि उन्हें किस "कीवर्ड घनत्व" — यानी उन शब्दों का प्रतिशत जो कोई लक्षित वाक्यांश हैं — का लक्ष्य रखना चाहिए। ईमानदार जवाब है कि कोई लक्ष्य संख्या नहीं है। Google की अपनी स्पैम नीतियाँ कीवर्ड स्टफ़िंग (रैंकिंग में हेरफेर के लिए शब्दों को अस्वाभाविक रूप से दोहराना) को एक उल्लंघन मानती हैं जो किसी पेज को मदद के बजाय नुक़सान पहुँचा सकता है, इसलिए लक्ष्य स्वाभाविक भाषा है, कोई अनुपात नहीं। फिर भी यहाँ शब्द काउंटर उपयोगी है: यह आपको जाँचने देता है कि 1,200-शब्द का लेख सचमुच सारगर्भित है, और जिस वाक्यांश पर आपने ज़ोर दिया है वह इतनी बार न आए कि गद्य पढ़ने में अटपटा लगे।

एक अधिक रचनात्मक माप है पठनीयता। सबसे प्रसिद्ध माप Flesch Reading Ease स्कोर है, जिसे Rudolf Flesch ने 1948 में तैयार किया, जो छोटे वाक्यों और छोटे शब्दों को पुरस्कृत करता है। इसका सूत्र है:

206.835 − 1.015 × (words ÷ sentences) − 84.6 × (syllables ÷ words)

इसके दो इनपुट हैं औसत वाक्य लंबाई (कुल शब्द भाग कुल वाक्य) और प्रति शब्द औसत अक्षर (सिलेबल)। स्कोर 0 से 100 तक होते हैं: 90–100 का परिणाम बहुत आसानी से पढ़ा जाता है, लगभग 60 सरल अंग्रेज़ी है जिसे एक सामान्य 13 से 15 साल का किशोर समझ सकता है, और 30 से नीचे घना, अकादमिक गद्य है। इस पेज पर वाक्य और शब्द की गणना आपको उस हिसाब का पहला आधा हिस्सा सीधे दे देती है — यह देखने का एक तेज़ तरीक़ा कि कहीं आपका औसत वाक्य 20-शब्द की सीमा को तो पार नहीं कर गया, जहाँ पठनीयता आमतौर पर गिरने लगती है।

अक्सर पूछे जाने वाले सवाल

शब्द कैसे गिने जाते हैं?
शब्द वे होते हैं जो स्पेस, टैब या नई पंक्ति से अलग किए गए बिना-रिक्त वर्णों के क्रम हैं। संख्याएँ ("123"), हाइफ़न वाले शब्द ("well-being") और संक्षिप्त रूप ("don't") — हर एक को एक शब्द गिना जाता है। खाली पंक्तियाँ और शुरुआत/अंत की रिक्त जगह शब्दों में नहीं जुड़तीं।
पढ़ने का समय कैसे निकाला जाता है?
पढ़ने का समय 200 शब्द प्रति मिनट के आधार पर निकाला जाता है, जो वेब सामग्री के लिए एक वयस्क की औसत मौन-पठन गति है। शैक्षणिक शोध (Trauzettel-Klosinski और Dietz, 2012) इसका औसत 200–300 शब्द/मिनट बताता है; 200 शब्द/मिनट एक सहज अनुमान देता है जो समय को कम करके नहीं आँकता।
क्या वर्ण गणना में स्पेस शामिल होते हैं?
दोनों गणनाएँ दिखाई जाती हैं। "वर्ण (स्पेस सहित)" कुल कोडपॉइंट गणना है, जिसे अधिकांश प्लेटफ़ॉर्म (X, Instagram, LinkedIn) अपनी वर्ण-सीमा के लिए इस्तेमाल करते हैं। "वर्ण (बिना स्पेस)" रिक्त जगह को छोड़ देता है, जो SEO वर्ण-बजट के लिए उपयोगी है जहाँ स्पेस कीवर्ड घनत्व में योगदान नहीं देते।
क्या मेरा टेक्स्ट किसी सर्वर पर भेजा जाता है?
नहीं। पूरी गणना आपके ब्राउज़र में ही JavaScript से चलती है। आपका टेक्स्ट कभी आपके डिवाइस से बाहर नहीं जाता।
कभी-कभी वाक्य कम क्यों गिने जाते हैं?
वाक्य पहचान ". ! ?" के बाद रिक्त जगह या इनपुट के अंत पर विभाजन करती है। किसी वाक्य के भीतर "Dr." या "U.S.A." जैसे संक्षिप्त रूप वाक्य-सीमा जैसे दिख सकते हैं — यह विराम-चिह्न आधारित गणना की एक ज्ञात सीमा है। अंतिम दस्तावेज़ में सटीक गणना के लिए हमेशा मैन्युअल समीक्षा करें।

संबंधित टूल

और टूल्स देखें

सभी 90 टूल्स देखें →