onlinetools.dev

글자 수 세기

단어·문자·문장·바이트·읽기 시간을 실시간 집계

로컬 실행
loading…
이 도구에 대해

개발자와 작가가 실제로 필요로 하는 숫자를 보여주는 실시간 단어·문자 카운터입니다. 단어 수, 공백 포함/제외 문자 수, UTF-8 바이트 수(데이터베이스 컬럼이나 API 제한이 실제로 측정하는 것), 줄 수, 문장 수, 단락 수, 그리고 일반적인 분당 220단어 기준의 예상 읽기 시간까지.

문자는 UTF-16 단위가 아니라 Unicode 코드 포인트로 세므로, 이모지와 CJK 텍스트가 사람이 기대하는 방식으로 계산됩니다. 그리고 별도의 바이트 수가 그 차이를 보여줍니다. 日本語는 3문자이지만 9바이트입니다. 이 구분이 바로 VARCHAR(255) 컬럼이 200"문자"짜리 문자열을 거부할 때 발목을 잡는 지점입니다.

모든 것이 입력과 동시에 갱신되고 어디로도 전송되지 않습니다. 공지 초안, 계약서, 아직 세상에 공개할 준비가 안 된 어떤 것이든 안심하고 셀 수 있습니다.

자주 묻는 질문

왜 문자 수와 바이트 수가 다른가요?
문자는 Unicode 코드 포인트이고 바이트는 그 UTF-8 인코딩입니다. ASCII 문자는 각 1바이트, 대부분의 유럽 악센트 문자는 2바이트, CJK 문자는 3바이트, 이모지는 4바이트(시퀀스에서는 더 많이)입니다. 데이터베이스 제한, HTTP 헤더, 많은 API가 측정하는 것은 문자가 아니라 바이트입니다.
공백이 없는 언어의 단어는 어떻게 세나요?
단어 계산은 공백 기준으로 나누므로, 분절되지 않은 중국어나 일본어 텍스트는 과소 집계됩니다. 그런 언어에서는 문자 수가 더 의미 있는 지표이며, 두 수치가 항상 함께 표시되는 이유입니다.
무엇이 한 문장으로 계산되나요?
., !, ? 또는 … 로 끝나고 공백이나 입력의 끝이 뒤따르는 텍스트 구간입니다. "e.g." 같은 약어는 계산을 약간 부풀릴 수 있습니다. 문장 계산은 본질적으로 휴리스틱입니다.
읽기 시간은 얼마나 정확한가요?
단어 수를 성인이 일반 산문을 묵독하는 흔한 평균치인 220 wpm으로 나눈 값입니다. 코드가 포함된 기술 자료는 더 느리게 읽히고, 훑어보기 좋은 리스트형 글은 더 빠릅니다. 자릿수 수준의 추정치로 받아들이세요.
관련 도구