Счётчик слов
Считайте слова, символы, предложения, байты и время чтения на лету
Об этом инструменте
Живой счётчик слов и символов с показателями, которые реально нужны разработчикам и авторам: слова, символы с пробелами и без, байты UTF-8 (то, что на самом деле измеряет ваша колонка базы данных или лимит API), строки, предложения, абзацы и оценка времени чтения из расчёта типичных 220 слов в минуту.
Символы считаются как кодовые точки Unicode, а не единицы UTF-16, поэтому эмодзи и текст CJK считаются так, как ожидает человек, — а отдельный счётчик байтов делает разницу видимой: 日本語 — это 3 символа, но 9 байт. Именно это различие кусается, когда колонка VARCHAR(255) отвергает строку из 200 «символов».
Всё обновляется по мере набора, и никуда ничего не отправляется — можно безопасно считать черновики анонсов, договоры и всё остальное, что ещё не готово для мира.
Частые вопросы
- Почему количество символов и байтов различается?
- Символы — это кодовые точки Unicode; байты — их кодировка UTF-8. Буквы ASCII занимают по 1 байту, большинство европейских букв с диакритикой — 2, символы CJK — 3, эмодзи — 4 (или больше в последовательностях). Лимиты баз данных, HTTP-заголовки и многие API измеряют байты, а не символы.
- Как считаются слова для языков без пробелов?
- Подсчёт слов разбивает текст по пробельным символам, что занижает счёт для несегментированного текста на китайском или японском. Для таких языков более осмысленной метрикой является количество символов — поэтому оба показателя всегда показаны.
- Что считается предложением?
- Фрагмент текста, заканчивающийся на ., !, ? или …, за которым следует пробел или конец ввода. Сокращения вроде «e.g.» могут слегка завысить счёт — подсчёт предложений по своей природе эвристика.
- Насколько точна оценка времени чтения?
- Она делит количество слов на 220 слов в минуту — распространённое среднее для взрослого чтения обычной прозы про себя. Технический материал с кодом читается медленнее; беглые списки — быстрее. Воспринимайте это как оценку порядка величины.