文字数カウンター
単語数・文字数・文数・バイト数・読了時間をリアルタイム集計
ローカル実行
loading…
このツールについて
開発者とライターが本当に必要とする数値を出すライブの単語・文字カウンターです。単語数、スペース込み・抜きの文字数、UTF-8 バイト数(データベースの列や API の制限が実際に測っているもの)、行数、文の数、段落数、そして一般的な毎分 220 語での推定読了時間です。
文字は UTF-16 ユニットではなく Unicode コードポイントで数えるため、絵文字や CJK テキストも人間の期待どおりに数えられます — そして独立したバイト数の表示がその差を可視化します。日本語は 3 文字ですが 9 バイトです。この違いこそ、VARCHAR(255) の列が 200「文字」の文字列を拒否するときに噛みついてくるものです。
すべては入力に合わせて更新され、どこにも送信されません — アナウンスの下書き、契約書、まだ世に出せないものを数えても安全です。
よくある質問
- なぜ文字数とバイト数が違うのですか?
- 文字は Unicode コードポイントで、バイトはその UTF-8 エンコーディングです。ASCII 文字は各 1 バイト、ヨーロッパのアクセント付き文字の多くは 2 バイト、CJK 文字は 3 バイト、絵文字は 4 バイト(シーケンスではそれ以上)です。データベースの制限、HTTP ヘッダー、多くの API は文字数ではなくバイト数を測ります。
- スペースのない言語では単語はどう数えられますか?
- 単語のカウントは空白で分割するため、分かち書きされていない中国語や日本語のテキストでは少なめに数えられます。それらの言語では文字数のほうが意味のある指標です。両方を常に表示しているのはそのためです。
- 何が 1 つの文として数えられますか?
- .、!、?、または … で終わり、その後に空白か入力の終端が続くテキストのまとまりです。「e.g.」のような略語はカウントをわずかに膨らませることがあります — 文のカウントは本質的にヒューリスティックです。
- 読了時間はどのくらい正確ですか?
- 単語数を 220 wpm で割ったものです。これは成人が一般的な散文を黙読するときのよくある平均値です。コードを含む技術資料はもっと遅く、流し読みできるリスト記事はもっと速く読めます。桁の見積もりとして扱ってください。