같은 글인데 글자 수가 다른 이유

공백 포함·제외, 줄바꿈, 이모지, UTF-8 바이트 수를 Toolify의 실제 집계 방식과 예제로 비교합니다.

먼저 공백 포함 기준을 확인하세요

같은 원고를 두 사이트에 붙여넣었는데 숫자가 다르면 공백 처리부터 확인하세요. 글자 사이의 스페이스뿐 아니라 줄바꿈과 탭도 공백으로 처리할 수 있습니다. Toolify의 ‘공백 제외’는 스페이스, 줄바꿈, 탭 등 공백 문자를 제거한 뒤 셉니다.

입력: 안녕 ABC

공백 포함 6 · 공백 제외 5 · UTF-8 10바이트

한글 2개 + 스페이스 1개 + 영문 3개를 각각 계산한 결과입니다.

모집 공고나 원고 제출 화면이 ‘공백 포함’이라고 안내하면 포함 수치를 먼저 보세요. 최종 제출 서비스가 자체적으로 표시하는 수치가 있다면 그 서비스의 집계 기준도 함께 확인해야 합니다.

바이트는 글을 저장하는 데 필요한 크기예요

글자 수는 텍스트 길이를 세는 값이고, 바이트 수는 인코딩한 데이터의 크기입니다. Toolify는 UTF-8 기준으로 바이트를 계산합니다. 기본 영문자와 숫자는 보통 1바이트이고, 완성형 한글 음절은 보통 3바이트입니다. 한글 한 글자를 무조건 2바이트라고 보고 환산하면 이 도구의 결과와 맞지 않습니다.

Toolify에 그대로 입력했을 때의 값
입력공백 포함 수UTF-8
ABC33바이트
한글26바이트
안녕 ABC610바이트
😀24바이트

이 수치는 입력 텍스트 자체의 크기입니다. 워드 문서나 이미지가 포함된 파일의 전체 용량과는 다릅니다. 또한 제출처가 UTF-8 이외의 인코딩이나 자체 환산 규칙을 쓰면 같은 텍스트의 바이트 제한 결과도 달라집니다.

이모지는 눈에 보이는 개수와 다를 수 있어요

현재 Toolify의 글자 수는 JavaScript 문자열 길이, 즉 UTF-16 코드 단위로 집계합니다. 일반적인 한글과 영문에서는 익숙한 글자 수와 같지만, 😀처럼 코드 단위 두 개가 필요한 이모지는 2로 표시됩니다. 여러 문자가 결합된 이모지는 화면에 하나로 보여도 더 큰 값으로 집계될 수 있습니다.

따라서 이 도구의 수치는 ‘눈에 보이는 문자 덩어리의 개수’를 세는 방식과 다릅니다. 이모지나 결합 문자가 많은 문장은 제출할 서비스의 실제 입력란에서도 확인하세요. 이 집계 특성은 MDN의 문자열 길이 설명에서 확인할 수 있습니다. 바이트 표시는 Blob의 바이트 크기를 사용합니다.

줄바꿈까지 포함해 최종 원고를 확인하세요

  1. 원고 전체를 붙여넣습니다. 제목을 제출 내용에 포함한다면 제목도 함께 넣습니다.
  2. 제출처가 정한 공백 포함·제외 또는 바이트 기준에 맞는 수치를 봅니다.
  3. 줄바꿈과 이모지를 수정했다면 다시 확인합니다.
  4. 마지막으로 실제 제출 화면에 붙여넣어 해당 화면의 제한도 확인합니다.

Toolify의 단어 수는 공백으로 나눈 덩어리 수이며, 한국어 형태소 수를 분석하는 기능은 아닙니다. 빈 입력의 줄 수는 0이고 줄바꿈을 입력하면 줄 수가 늘어납니다. 내용 뒤에 남은 빈 줄도 결과에 영향을 줄 수 있습니다.

글자수 세기 열기 ↗

함께 읽기