शब्द और अक्षर कैसे गिनें (और टूल अलग संख्या क्यों देते हैं)
देवनागरी में मात्रा, संयुक्त व्यंजन और हलंत एक “अक्षर” की धारणा को आसान अंग्रेज़ी गिनती से अलग कर देते हैं। इसलिए दो साइट एक ही पैराग्राफ पर अलग अंक दिखा सकती हैं। शब्द गणक अपना तरीका साफ लिखता है: उपलब्ध हो तो सक्रिय भाषा वाला Intl.Segmenter, यूनिकोड NFC, ग्रेफेम अक्षर, और शून्य-चौड़ाई चिह्न अक्षर योग से बाहर। नीचे का उदाहरण चिपकाएँ: 11 शब्द, स्पेस सहित 38 अक्षर, बिना स्पेस 28, 2 वाक्य, 1 अनुच्छेद, 1 पंक्ति दिखने चाहिए।
मात्रा और संयुक्त अक्षर
नमस्ते NFC के बाद 3 ग्रेफेम अक्षर गिने जाते हैं (न, मस्, ते के रूप में खंडन Segmenter/ग्रेफेम नियमों पर निर्भर)। अगर कोई संपादक कोड पॉइंट बिना सामान्यीकरण गिने, वही शब्द लंबा लग सकता है। शीर्षक “एक अक्षर बचा” कहकर काटने से पहले पूछें कि सीमा कौन सा मॉडल इस्तेमाल करती है।
हिंदी में शब्द आमतौर पर स्पेस से बँटे होते हैं, फिर भी इमोजी, अंग्रेज़ी शब्द और छिपे नियंत्रण चिह्न योग हिला देते हैं। “स्पेस सहित” उन खाली जगहों को रखता है; “बिना स्पेस” हटाता है। कोई भी मोड चैट से आए ZWSP को नहीं जोड़ना चाहिए।
यहाँ शब्द क्या है
Segmenter होने पर शब्द भाषा का शाब्दिक खंड है, “दो स्पेस के बीच सब कुछ” नहीं। Segmenter न हो तो यूनिकोड पैटर्न वाला बैकअप चलता है और शुद्ध विराम चिह्न तथा स्पेस छोड़ता है। जब वाक्य में अंक, अंग्रेज़ी नाम या इमोजी मिले हों, यह फर्क बड़ा हो जाता है।
जाँचा हुआ उदाहरण: हिंदी नमूना
नमस्ते दुनिया। यह शब्द गणक के लिए एक छोटा उदाहरण है।
hi लोकेल पर साइट की लाइब्रेरी 11 शब्द, स्पेस सहित 38, बिना स्पेस 28, 2 वाक्य, 1 अनुच्छेद, 1 पंक्ति बताती है। 200 शब्द/मिनट पढ़ने पर 4 सेकंड। 130 बोलने पर 6 सेकंड। सूत्र: ceil(शब्द ÷ शब्द/मिनट × 60)। ग्यारह शब्द 200 पर एक मिनट के दसवें हिस्से से कम हैं; ऊपर की ओर पूर्णांक सेकंड स्क्रीन पर समझाते हैं।
ध्यान दें: हिंदी में पूर्ण विराम अक्सर । (दंडा) होता है। Segmenter इसे वाक्य सीमा मान सकता है; कुछ पुराने टूल केवल लैटिन . पहचानते हैं और वाक्य गिनती घटा देते हैं।
वाक्य, अनुच्छेद, पंक्ति
वाक्य Segmenter उपलब्ध होने पर वाक्य खंडन का अनुसरण करते हैं। अनुच्छेद खाली पंक्ति से अलग गैर-खाली ब्लॉक हैं। पंक्तियाँ बॉक्स में Enter पर चलती हैं: स्क्रीन पर नरम लपेट अभी भी एक पंक्ति है जब तक Enter न दबें।
दो अनुच्छेदों का उदाहरण
पहला अनुच्छेद।
दूसरे अनुच्छेद में यहाँ और शब्द हैं।
परिणाम: 9 शब्द, 2 वाक्य, 2 अनुच्छेद, 3 पंक्तियाँ। अनुच्छेद दोहराव सूची में 2 बार आता है। खाली पंक्तियाँ अनदेखी करने वाला टूल उतने ही शब्दों पर कम पंक्तियाँ बताएगा। स्कूल का काम पंक्ति गिने तो खाली पंक्ति का नियम भी मिलाएँ।
संख्याएँ क्यों नहीं मिलतीं
- शब्द सीमा के नियम अलग।
- अक्षर मॉडल अलग (ग्रेफेम, कोड पॉइंट, UTF-16)।
- छिपे अक्षर गिने जाएँ या नहीं।
- NFC हो या न हो।
- SMS सीमा: GSM 160 खंड UCS-2 70 जितना बजट नहीं।
दो काउंटर मिलाते समय एक बार में एक चीज़ बदलें: पहले छिपे हटाएँ, फिर सामान्यीकरण, फिर शब्द।
बिना स्टॉप सूची के दोहराव
सबसे दोहराए शब्दों की सूची लोकेल के अनुसार केस मिलाती है और कच्ची आवृत्ति से क्रम देती है। “और” या “के” नहीं हटाती। ड्राफ्ट और समीक्षा के लिए है, भराव SEO के लिए नहीं।
बिल्ली बिल्ली बिल्ली कुत्ता कुत्ता पक्षी
बिल्ली 3 बार, कुत्ता 2 बार; पक्षी एक बार होने से सूची में नहीं आता।
टूल कैसे इस्तेमाल करें
- शब्द गणक खोलें।
- पाठ लिखें या चिपकाएँ (
dir="auto"सामग्री की दिशा का अनुसरण करता है)। - दर्शक औसत से अलग हों तो पढ़ने और बोलने की गति बदलें।
- वैकल्पिक: अक्षर सीमा (SMS प्रीसेट या अपनी संख्या)।
- सार चाहिए तो आँकड़े कॉपी करें।
बड़े पेस्ट पेज न अटके इसलिए थोड़ी देर से विश्लेषित होते हैं। सर्वर पर कुछ नहीं जाता। होमवर्क, कैप्शन या लंबा संदेश चिपकाकर तुरंत परिणाम देख सकते हैं। देवनागरी फ़ॉन्ट पृष्ठ पर पढ़ने के लिए चुना गया है।
आम गलतियाँ
तरीके बिना योग मिलाना। फर्क लगभग हमेशा परिभाषा है।
गलत मॉडल से काटना। ग्रेफेम बनाम कोड पॉइंट सीमा में बचा हिस्सा बदल देता है।
पढ़ने के समय को वादा समझना। शब्द/मिनट एक धारणा है। ज़ोर से पढ़ने या धीमे दर्शक के लिए बदलें।
दोहरा Enter भूलना। इससे अनुच्छेद और पंक्ति बढ़ती है।
बिना स्रोत सोशल सीमा पर भरोसा। दस्तावेज़ी सीमा और नियम अस्पष्ट हो तो अपनी छत चुनें।
अभी आज़माएँ
“नमस्ते दुनिया” नमूने पर 11 / 38 / 28 जाँचें, फिर बिल्ली वाली पंक्ति पर दोहराव देखें। बोलने की गति घटाएँ; शब्द योग स्थिर रहते हुए बोलने का समय बढ़े। अंक न मिलें तो पहले छिपे अक्षर ढूँढें, फिर काउंटर पर शक करें।
अक्सर पूछे जाने वाले प्रश्न
एक ही पाठ पर दो काउंटर अलग योग क्यों देते हैं?
अक्सर शब्द की परिभाषा (हाइफ़न, संक्षिप्त रूप, इमोजी) और अक्षर ग्रेफेम है या कोड पॉइंट, इसमें फर्क होता है। सिर्फ बड़ा नंबर नहीं, तरीका मिलाएँ।
क्या इमोजी यहाँ एक अक्षर गिना जाता है?
Intl.Segmenter हो तो हाँ। अक्षर योग ग्रेफेम क्लस्टर से आता है, इसलिए एक इमोजी या संयुक्त अक्षर एक दिखाई देने वाला चिह्न गिना जाता है। शून्य-चौड़ाई चिह्न योग से बाहर रहते हैं।
स्पेस वाले और बिना स्पेस वाले अक्षरों में क्या अंतर है?
स्पेस वाले में स्पेस ग्रेफेम शामिल हैं। बिना स्पेस में वे नहीं। दोनों शून्य-चौड़ाई प्रारूप अक्षर हटाते हैं।
पढ़ने और बोलने का समय कैसे अनुमानित होता है?
सेकंड = ceil(शब्द ÷ शब्द/मिनट × 60)। डिफ़ॉल्ट पढ़ना 200 और बोलना 130। टूल में दोनों गति बदल सकते हैं।
क्या मेरा पाठ सर्वर पर जाता है?
नहीं। काउंटर ब्राउज़र में चलता है और आप जो लिखते हैं उसे सहेजता नहीं।
क्या सोशल ऐप की सीमा पर भरोसा करूँ?
केवल जब उत्पाद दस्तावेज़ करे। यहाँ जाँचे गए SMS प्रीसेट (160 GSM और 70 UCS-2) और अपनी सीमा है।