글자 수 세기
단어·문자·문장·바이트·읽기 시간을 실시간 집계
로컬 실행
loading…
이 도구에 대해
개발자와 작가가 실제로 필요로 하는 숫자를 보여주는 실시간 단어·문자 카운터입니다. 단어 수, 공백 포함/제외 문자 수, UTF-8 바이트 수(데이터베이스 컬럼이나 API 제한이 실제로 측정하는 것), 줄 수, 문장 수, 단락 수, 그리고 일반적인 분당 220단어 기준의 예상 읽기 시간까지.
문자는 UTF-16 단위가 아니라 Unicode 코드 포인트로 세므로, 이모지와 CJK 텍스트가 사람이 기대하는 방식으로 계산됩니다. 그리고 별도의 바이트 수가 그 차이를 보여줍니다. 日本語는 3문자이지만 9바이트입니다. 이 구분이 바로 VARCHAR(255) 컬럼이 200"문자"짜리 문자열을 거부할 때 발목을 잡는 지점입니다.
모든 것이 입력과 동시에 갱신되고 어디로도 전송되지 않습니다. 공지 초안, 계약서, 아직 세상에 공개할 준비가 안 된 어떤 것이든 안심하고 셀 수 있습니다.
자주 묻는 질문
- 왜 문자 수와 바이트 수가 다른가요?
- 문자는 Unicode 코드 포인트이고 바이트는 그 UTF-8 인코딩입니다. ASCII 문자는 각 1바이트, 대부분의 유럽 악센트 문자는 2바이트, CJK 문자는 3바이트, 이모지는 4바이트(시퀀스에서는 더 많이)입니다. 데이터베이스 제한, HTTP 헤더, 많은 API가 측정하는 것은 문자가 아니라 바이트입니다.
- 공백이 없는 언어의 단어는 어떻게 세나요?
- 단어 계산은 공백 기준으로 나누므로, 분절되지 않은 중국어나 일본어 텍스트는 과소 집계됩니다. 그런 언어에서는 문자 수가 더 의미 있는 지표이며, 두 수치가 항상 함께 표시되는 이유입니다.
- 무엇이 한 문장으로 계산되나요?
- ., !, ? 또는 … 로 끝나고 공백이나 입력의 끝이 뒤따르는 텍스트 구간입니다. "e.g." 같은 약어는 계산을 약간 부풀릴 수 있습니다. 문장 계산은 본질적으로 휴리스틱입니다.
- 읽기 시간은 얼마나 정확한가요?
- 단어 수를 성인이 일반 산문을 묵독하는 흔한 평균치인 220 wpm으로 나눈 값입니다. 코드가 포함된 기술 자료는 더 느리게 읽히고, 훑어보기 좋은 리스트형 글은 더 빠릅니다. 자릿수 수준의 추정치로 받아들이세요.