Licznik słów
Licz słowa, znaki, zdania, bajty i czas czytania w trakcie pisania
O tym narzędziu
Licznik słów i znaków działający na żywo, podający liczby, których programiści i piszący naprawdę potrzebują: słowa, znaki ze spacjami i bez, bajty UTF-8 (czyli to, co faktycznie mierzy kolumna w bazie albo limit API), wiersze, zdania, akapity oraz szacowany czas czytania przy typowych 220 słowach na minutę.
Znaki liczone są jako punkty kodowe Unicode, a nie jednostki UTF-16, więc emoji i tekst CJK liczą się tak, jak spodziewałby się człowiek — a osobna liczba bajtów uwidacznia różnicę: 日本語 to 3 znaki, ale 9 bajtów. Dokładnie to rozróżnienie boli, gdy kolumna VARCHAR(255) odrzuca ciąg mający 200 „znaków”.
Wszystko przelicza się w trakcie pisania i nic nigdzie nie jest wysyłane — bezpiecznie policzysz szkice ogłoszeń, umowy albo cokolwiek innego, co nie jest jeszcze gotowe na świat.
Często zadawane pytania
- Dlaczego liczba znaków różni się od liczby bajtów?
- Znaki to punkty kodowe Unicode; bajty to ich zapis w UTF-8. Litery ASCII zajmują po 1 bajcie, większość europejskich liter z akcentami 2, znaki CJK 3, a emoji 4 (lub więcej w sekwencjach). Limity baz danych, nagłówki HTTP i wiele API mierzą bajty, nie znaki.
- Jak liczone są słowa w językach bez spacji?
- Zliczanie słów dzieli tekst po białych znakach, co zaniża wynik dla niesegmentowanego tekstu chińskiego czy japońskiego. Dla tych języków sensowniejszą miarą jest liczba znaków — dlatego obie wartości są zawsze widoczne.
- Co liczy się jako zdanie?
- Ciąg tekstu zakończony znakiem ., !, ? albo …, po którym następuje biały znak lub koniec tekstu. Skróty w rodzaju „np.” mogą lekko zawyżyć wynik — liczenie zdań jest z natury heurystyczne.
- Jak dokładny jest czas czytania?
- Dzieli liczbę słów przez 220 słów na minutę, czyli częstą średnią dla cichego czytania prozy ogólnej przez osobę dorosłą. Materiał techniczny z kodem czyta się wolniej, listy do przeskanowania wzrokiem szybciej. Traktuj to jako szacunek co do rzędu wielkości.