शब्द गणक
टाइप करते ही शब्द, वर्ण, वाक्य, बाइट और पढ़ने का समय गिनिए
इस टूल के बारे में
एक लाइव शब्द और वर्ण गणक, उन आँकड़ों के साथ जो डेवलपर और लेखक वाक़ई चाहते हैं: शब्द, स्पेस सहित और बिना स्पेस वर्ण, UTF-8 बाइट (जो आपका डेटाबेस कॉलम या API सीमा असल में नापती है), पंक्तियाँ, वाक्य, अनुच्छेद, और सामान्य 220 शब्द प्रति मिनट की दर से पढ़ने का अनुमानित समय।
वर्ण यूनिकोड कोड पॉइंट के रूप में गिने जाते हैं, UTF-16 इकाइयों के रूप में नहीं, इसलिए इमोजी और CJK पाठ वैसे ही गिने जाते हैं जैसे कोई मनुष्य अपेक्षा करेगा — और अलग से बाइट गणना अंतर दिखा देती है: 日本語 तीन वर्ण हैं पर नौ बाइट। ठीक यही अंतर तब काटता है जब VARCHAR(255) कॉलम 200 “वर्ण” की स्ट्रिंग ठुकरा देता है।
सब कुछ टाइप करते ही अपडेट होता है और कहीं भेजा नहीं जाता — घोषणाओं के मसौदे, अनुबंध, या ऐसा कुछ भी गिनने के लिए सुरक्षित जो अभी दुनिया के लिए तैयार नहीं है।
अक्सर पूछे जाने वाले प्रश्न
- वर्ण और बाइट की गिनती अलग क्यों है?
- वर्ण यूनिकोड कोड पॉइंट हैं; बाइट उनकी UTF-8 एनकोडिंग। ASCII अक्षर एक बाइट के होते हैं, अधिकतर यूरोपीय स्वरचिह्न वाले अक्षर दो, CJK वर्ण तीन, और इमोजी चार (शृंखलाओं में उससे भी अधिक)। डेटाबेस सीमाएँ, HTTP हेडर और कई API बाइट नापते हैं, वर्ण नहीं।
- बिना स्पेस वाली भाषाओं के लिए शब्द कैसे गिने जाते हैं?
- शब्द-गणना खाली जगह पर विभाजन करती है, जिससे चीनी या जापानी जैसे अखंडित पाठ की गिनती कम पड़ जाती है। उन भाषाओं के लिए वर्ण-गणना अधिक सार्थक माप है — इसीलिए दोनों हमेशा दिखाए जाते हैं।
- वाक्य किसे माना जाता है?
- ऐसा पाठ-खंड जो ., !, ? या … पर समाप्त हो और उसके बाद खाली जगह या इनपुट का अंत आए। “आदि।” जैसे संक्षेप गिनती को थोड़ा बढ़ा सकते हैं — वाक्य गिनना स्वभाव से ही अनुमान-आधारित है।
- पढ़ने का समय कितना सटीक है?
- यह शब्द-संख्या को 220 शब्द प्रति मिनट से भाग देता है, जो वयस्कों द्वारा सामान्य गद्य के मौन पठन का प्रचलित औसत है। कोड वाली तकनीकी सामग्री धीमे पढ़ी जाती है; सूची-नुमा लेख तेज़ी से। इसे परिमाण-स्तर का अनुमान मानिए।