사용 방법
- 입력창에 글을 입력하거나 붙여 넣습니다.
- 입력창 아래의 숫자를 확인합니다. 입력하는 동안 바로 갱신됩니다.
- 제한에 맞는 숫자를 보세요. 공백 포함, 공백 제외, 단어 수, 바이트 수 중에서 고를 수 있습니다.
예시
Hello, world!
→ 13글자, 공백 제외 12글자, 2단어
안녕 하세요
→ 6글자, 공백 제외 5글자, 2단어, UTF-8 16바이트한글 한 글자는 UTF-8에서 3바이트이고 공백은 1바이트입니다.
Line one⏎Line two (두 줄)
→ 17글자, 공백 제외 14글자, 4단어, 2줄줄바꿈은 한 글자로, 그리고 공백으로 셉니다.
계산 방식
숫자는 입력창에 있는 텍스트 그대로를 기준으로 계산합니다.
- 글자 수는 공백과 줄바꿈을 포함한 유니코드 코드 포인트의 수입니다.
- 공백 제외는 모든 공백 문자(스페이스, 탭, 줄바꿈)를 뺀 뒤 센 값입니다.
- 단어 수는 공백으로 구분된, 공백이 아닌 텍스트 덩어리의 수입니다.
- 줄 수는 줄바꿈으로 나뉜 조각의 수입니다. 빈 텍스트는 0줄입니다.
- UTF-8 바이트는 텍스트를 대부분의 웹사이트가 쓰는 UTF-8로 인코딩했을 때의 크기입니다.
이 도구는 눈에 보이는 기호가 아니라 코드 포인트를 세므로, 가족 이모지처럼 여러 코드 포인트로 이루어진 이모지는 한 글자보다 많게 셉니다.
출처
자주 묻는 질문
- 공백도 글자 수에 포함되나요?
- 네, 기본 글자 수에는 포함됩니다. '공백 제외' 수는 모든 스페이스, 탭, 줄바꿈을 뺀 값입니다.
- 단어 수는 어떻게 세나요?
- 공백으로 구분된 덩어리를 한 단어로 셉니다. 중국어나 일본어처럼 단어 사이에 공백이 없는 언어는 단어 수가 적게 나옵니다.
- 바이트 수가 글자 수와 다른 이유는 무엇인가요?
- UTF-8에서는 글자마다 크기가 다릅니다. 영문 기본 문자는 1바이트, 한글과 대부분의 한자, 일본어 문자는 3바이트, 많은 이모지는 4바이트입니다.
- 다른 도구와 숫자가 다르게 나오는 이유는 무엇인가요?
- 도구마다 줄바꿈, 이모지, 결합 문자를 세는 방식이 다릅니다. 이 도구는 유니코드 코드 포인트를 세므로, 여러 부분으로 이루어진 이모지 하나가 한 글자보다 많게 셀 수 있습니다.
- 입력한 글이 업로드되나요?
- 아니요. 세는 작업은 브라우저 안에서만 이루어지고 글은 어디로도 전송되지 않습니다.