사이트마다 글자수가 다른 이유
같은 글인데 사이트마다 글자수가 다르게 나오는 이유(줄바꿈, 공백, 바이트, 이모지)를 예시로 정리하고 제출 전에 확인할 점을 알려 드립니다.
검토일: 2026-10-05 · 출처 확인일: 2026-10-05
같은 글인데 왜 사이트마다 글자수가 다르게 나오나요?
줄바꿈을 1자로 셀지 2자(CR+LF)로 셀지, 공백을 뺄지, 글자 대신 바이트로 셀지, 이모지·조합형 한글을 한 글자로 볼지가 서비스마다 다르기 때문입니다. 제출처가 쓰는 기준(공백 포함/제외, 바이트)을 먼저 확인하고 같은 항목의 숫자를 보세요.
1. 차이가 나는 네 가지
| 항목 | 다르게 세는 방식 |
|---|---|
| 줄바꿈 | 1자(LF)로 세거나, Windows 방식 CR+LF를 2자로 세기도 합니다. |
| 공백 | 공백 포함·제외를 따로 보여주거나 하나만 보여줍니다. |
| 바이트 | 한글 1자를 UTF-8 3바이트로 세거나, 예전 방식(EUC-KR 계열) 2바이트로 셉니다. |
| 이모지·조합형 | 눈에 보이는 1자를 여러 코드로 나눠 2자 이상으로 세기도 합니다. |
2. 예시
| 글 | 공백 포함 | 공백 제외 | UTF-8 바이트 | 줄 수 |
|---|---|---|---|---|
| 안녕하세요 | 5 | 5 | 15 | 1 |
| 안녕하세요⏎반갑습니다 | 11 | 10 | 31 | 2 |
| 👍 좋아요 | 5 | 4 | 14 | 1 |
글체크는 줄바꿈 1자, 이모지 1자(눈에 보이는 글자 기준), 바이트는 UTF-8로 셉니다.
3. 제출 전 확인할 것
- 제출처가 '공백 포함'인지 '공백 제외'인지
- 바이트 제한이면 어떤 인코딩 기준인지
- 여유를 두고 제한보다 조금 짧게 맞추기
기준과 출처
- 계산: 본문의 글자수 예시 표는 이 사이트 작업 화면과 같은 코드로 만들었습니다.
- Unicode UAX #29: 사용자가 인식하는 글자(grapheme cluster) 경계 규칙
- Intl.Segmenter (MDN): 브라우저의 글자 단위 나누기 (2026-10-05 확인)