같은 글인데 바이트 수가 다르게 나오는 이유

2026-09-24 · 글쓴이 딸깍이 아저씨 (Mr. Ddalkak Uncle)

"1,000바이트 이내로 작성하세요."

같은 글인데 바이트 수가 다르게 나오는 이유 대표 도식

입력창에는 500자를 썼는데 벌써 한도라고 나옵니다. 다른 곳에서는 333자에서 걸립니다. 같은 글인데 왜 다를까요.

한글 한 글자가 몇 바이트인지가 곳마다 다르기 때문입니다.

한글은 2바이트일 수도, 3바이트일 수도 있습니다

인코딩한글 1자영문·숫자 1자주로 쓰는 곳
EUC-KR (CP949)2바이트1바이트채용 사이트 자소서, 공공기관 서식
UTF-83바이트1바이트웹 문서, 파일 저장, 대부분의 최신 시스템

같은 "1,000바이트"라도 기준이 다르면 이렇게 갈립니다.

167자 차이입니다. 자소서를 쓰다가 갑자기 글자가 잘리는 경험은 대개 여기서 옵니다.

왜 두 가지가 공존하나

EUC-KR은 한글을 담기 위해 오래전에 만든 방식입니다. 한글에 2바이트만 쓰니 효율적이지만 한국어와 영어 말고는 담지 못합니다.

UTF-8은 전 세계 문자를 하나로 처리하려고 만든 방식입니다. 그 대가로 한글에 3바이트를 씁니다.

지금 만드는 시스템은 전부 UTF-8을 씁니다. 그런데 채용 시스템이나 공공기관 서식은 오래된 것이 많아 여전히 2바이트 기준으로 세는 곳이 남아 있어요.

어느 기준인지 알아내는 법

가장 확실한 건 직접 넣어보는 것입니다.

한글 10자를 입력하고 카운터를 보세요.

띄어쓰기와 줄바꿈도 세는지 같이 확인해 두면 나중에 헷갈리지 않습니다.

줄바꿈이 생각보다 많이 먹습니다

문단을 나누면 줄바꿈 문자가 들어갑니다. 이것도 바이트를 차지해요.

게다가 운영체제마다 다릅니다.

문단이 20개면 윈도우에서 40바이트를 더 씁니다. 한글 20자에 해당하는 양이에요. 한도에 아슬아슬하게 걸릴 때 문단을 줄이면 통과하는 경우가 이래서 생깁니다.

붙여넣으면 숫자가 바뀝니다

워드나 한글에서 작성한 글을 웹 입력창에 붙여넣으면 글자수가 달라지는 일이 흔합니다. 원인은 대개 이 셋입니다.

붙여넣은 뒤에 다시 세는 것이 안전합니다.

정리

자주 묻는 질문

글자수 제한과 바이트 제한 중 어느 쪽이 흔한가요?

요즘 만들어진 시스템은 대부분 글자수로 제한합니다. 바이트 제한은 오래된 시스템이나 데이터베이스 컬럼 크기를 그대로 노출한 경우에 남아 있습니다.

영어로 쓰면 더 많이 쓸 수 있나요?

바이트 기준이라면 그렇습니다. 영문·숫자는 어느 인코딩에서든 1바이트입니다. 다만 글자수 기준이라면 차이가 없습니다.

공백도 바이트에 들어가나요?

들어갑니다. 공백은 1바이트입니다. 띄어쓰기를 줄이면 바이트가 줄지만 읽기 어려워지니 권할 방법은 아닙니다.

이모지는 몇 바이트인가요?

UTF-8에서 대부분 4바이트입니다. 한글보다 큽니다. 게다가 피부색이나 성별이 붙은 이모지는 여러 문자가 합쳐진 형태라 8바이트를 넘기도 해요. 바이트 제한이 빡빡한 입력창에는 넣지 않는 편이 안전합니다.

한글 자모를 따로 쓰면 어떻게 되나요?

"각"처럼 완성된 글자는 한 문자지만, ㄱ+ㅏ+ㄱ으로 조합된 형태는 세 문자로 셉니다. 맥에서 만든 파일명을 윈도우에서 열 때 글자수가 달라 보이는 원인이 이것입니다. 눈에는 똑같이 보여도 시스템은 다르게 셉니다.


글쓴이 딸깍이 아저씨 (Mr. Ddalkak Uncle) · 글감 찾다 지쳐서 직접 도구를 만든 콘텐츠 운영자. 소개 보기