칸칸 소개
칸칸은 글자 수를 세는 도구예요. 같은 글도 공백을 넣느냐, 줄바꿈을 몇 자로 보느냐, 글자로 세느냐 바이트로 세느냐에 따라 숫자가 달라져요. 칸칸은 그 기준들을 한 화면에 나란히 놓고 보여 줘요.
이름은 원고지의 칸에서 왔어요. 한 칸에 한 글자.
세는 기준과 출처
- 글자: 유니코드 표준 부속서 UAX #29의 글자 묶음을 따라요(브라우저의 Intl.Segmenter). 이모지는 UTS #51의 이모지 묶음이에요.
- 바이트: UTF-8과 UTF-16은 유니코드 표준대로 세요. EUC-KR은 윈도우 코드 페이지 949(확장 완성형) 표를 써요. 2바이트 글자는 17,048자이고, 그 가운데 한글이 11,172자, 한자가 4,888자예요. 옛 완성형(KS X 1001)의 한글은 2,350자예요.
- X 가중 글자 수(영어판): X의 공개 라이브러리 twitter-text 3.1.0을 기준으로 했어요(확인일 2026-10-09).
- 문자(SMS)(영어판): 3GPP TS 23.038의 문자표와 TS 23.040의 이어 붙이기 규칙이에요.
- 원고지: 한 줄 20칸, 한 장 10줄에 한 칸 한 글자로 놓아요. 원고지 쓰기 규칙은 반영하지 않았어요.
어떻게 확인했나요
세는 로직은 화면과 따로 두고 자동 테스트 2만 3천여 개로 확인해요. 기준값은 같은 로직을 한 번 더 짠 것이 아니라 파이썬의 표준 코덱과 유니코드 라이브러리, npm twitter-text, 서로 다른 SMS 계산기 세 가지로 따로 구했어요. EUC-KR 표는 브라우저가 가진 표와 한 글자씩 견줘 차이가 없는 것을 확인했어요.
글은 어디로 가나요
어디로도 가지 않아요. 글은 브라우저 안에서만 세고, 이 사이트에는 글을 받는 서버가 없어요. 자소서 화면에서 '이 기기에 저장'을 켠 경우에만 이 브라우저의 저장소에 남아요. 광고는 Google 애드센스를 써요. 자세한 내용은 개인정보 처리방침에 있어요.
만든 곳과 문의
루멘랩(Lumen Lab)이 만들었어요. 틀린 숫자를 발견하면 woxocoso@gmail.com으로 알려 주세요.