자기소개서 분량 맞추기
지원서 항목의 '공백 포함 1,000자 이내' 같은 제한을 쓰는 동안 바로바로 확인합니다.
CHARACTER COUNTER · BYTES
몇 글자인지, 몇 바이트인지
자기소개서 한 문단이나 '가나다' 세 글자를 붙여 넣으면 공백 포함·제외 글자수, 단어수, 줄수, UTF-8 바이트를 입력하는 즉시 셉니다. '가나다'는 3글자, UTF-8 9바이트로 나옵니다.
| 글자수(공백 포함) | 0 |
|---|---|
| 글자수(공백 제외) | 0 |
| 단어수 | 0 |
| 줄수 | 0 |
| UTF-8 바이트 | 0 |
| 원고지(200자) | 0매 |
MADE FOR YOUR WORK
지원서 항목의 '공백 포함 1,000자 이내' 같은 제한을 쓰는 동안 바로바로 확인합니다.
VARCHAR 길이가 바이트 단위인 DB 에 한글을 넣기 전에 UTF-8 바이트가 넘치지 않는지 봅니다.
제목·요약문처럼 글자수 제한이 있는 곳에 넣을 문구를 다듬으며 길이를 맞춥니다.
200자 원고지 기준 매수를 보고 청탁 원고나 과제 분량을 대략 가늠합니다.
STEP BY STEP
이렇게 쓰세요
텍스트 칸에 직접 쓰거나 다른 곳에서 복사해 넣습니다.
글자수(공백 포함·제외), 단어수, 줄수, UTF-8 바이트, 원고지(200자)가 입력하는 즉시 바뀝니다.
제출처가 공백 포함인지 제외인지, 글자인지 바이트인지 확인하고 해당 줄을 봅니다.
지우기 버튼으로 칸을 비우고 다음 글을 셉니다.
UNDERSTAND THE BASICS
글자수는 사람이 보는 글자의 개수이고, 바이트는 그 글자를 컴퓨터에 저장할 때 드는 크기입니다. 같은 글자라도 인코딩에 따라 바이트가 달라집니다. 요즘 웹과 DB 의 표준인 UTF-8 에서 영문·숫자는 1바이트, 한글 완성형 한 글자는 3바이트, 이모지는 대부분 4바이트입니다.
예전 한국어 환경에서 쓰던 EUC-KR·CP949 에서는 한글이 2바이트입니다. 그래서 오래된 시스템이나 문자 메시지의 '80바이트' 같은 제한은 UTF-8 로 센 값과 맞지 않을 수 있습니다. 이 도구의 바이트는 UTF-8 기준만 보여 줍니다.
글자수도 생각보다 단순하지 않습니다. 이 도구는 유니코드 코드포인트 단위로 세어 이모지 하나를 1로 셉니다. 다만 피부색이 붙거나 여러 사람이 합쳐진 이모지, 국기처럼 여러 코드포인트로 된 문자는 2 이상으로 셀 수 있고, 맥에서 복사한 파일명처럼 자모가 풀어진 한글(NFD)은 한 음절이 2~3자로 셉니다.
| 문자 | 글자수 | UTF-8 바이트 | EUC-KR 바이트(참고) |
|---|---|---|---|
| A | 1 | 1 | 1 |
| 가 | 1 | 3 | 2 |
| 가나다 | 3 | 9 | 6 |
| 공백 한 칸 | 1 | 1 | 1 |
| 줄바꿈 | 1 | 1 | 1 |
| 😀 | 1 | 4 | 표현 불가 |
공백 포함·제외 글자수, 단어수, 줄수, UTF-8 바이트와 200자 원고지 매수를 실시간 계산합니다.
텍스트를 입력하거나 붙여 넣어 글자 수·단어 수 등 표시된 항목을 확인하세요. 공백과 줄바꿈 포함 여부를 구분해 원하는 기준으로 사용하세요.
QUICK EXAMPLE
가나다
3글자 · UTF-8 9바이트
이모지와 결합 문자는 화면에 보이는 글자 수와 코드포인트 수가 다를 수 있습니다.
글자 수는 Array.from 으로 셉니다. 문자열의 length 는 UTF-16 단위라서 이모지 하나가 2로 세어지는데, Array.from 은 코드포인트 단위로 나눠 사람이 세는 숫자에 가깝습니다.
바이트는 TextEncoder 로 UTF-8 인코딩한 길이입니다. 한글은 한 글자에 3바이트라, 글자 수 제한이 아니라 바이트 제한이 걸린 컬럼이나 API 를 다룰 때 이 숫자가 필요합니다.
원고지 매수는 전체 글자 수를 200으로 나눈 값입니다. 실제 원고지는 줄바꿈마다 남는 칸이 생기므로 어림값입니다.
BEFORE YOU FINISH
이 도구는 줄바꿈도 공백 포함 글자수에 1자로 넣습니다. 제출 사이트가 줄바꿈을 빼고 센다면 문단 수만큼 차이가 납니다.
DB 컬럼이 VARCHAR(100) 이라도 DB 에 따라 100글자일 수도, 100바이트일 수도 있습니다. MySQL utf8mb4 는 글자, Oracle 은 기본 설정에서 바이트 기준입니다.
원고지 매수는 공백 포함 글자수를 200으로 나눈 어림값입니다. 실제 원고지는 문단마다 남는 칸이 생겨 더 많이 나옵니다.
공백 포함은 띄어쓰기와 줄바꿈까지 모두 센 값이고, 공백 제외는 띄어쓰기·탭·줄바꿈을 빼고 센 값입니다. 어느 쪽을 쓰는지는 회사·사이트마다 다르니 공고를 확인하세요.
UTF-8 에서는 3바이트, EUC-KR·CP949 에서는 2바이트입니다. 이 도구의 바이트 칸은 UTF-8 기준입니다.
흔한 원인은 줄바꿈을 세는 방식 차이입니다. 어떤 곳은 줄바꿈을 2자로, 어떤 곳은 0자로 셉니다. 이 도구는 1자로 셉니다.
공백으로 나뉜 덩어리 수입니다. '안녕하세요 반갑습니다'는 2단어로, 조사가 붙은 어절도 한 단어로 셉니다.
일반 이모지는 1글자, UTF-8 4바이트입니다. 여러 이모지를 이어 붙여 만든 가족·직업 이모지나 국기는 2글자 이상으로 셀 수 있습니다.
이 도구의 입력 데이터는 브라우저에서 처리하며 도구 기능을 위해 서버로 업로드하지 않습니다. 결과를 공유하기 전 민감한 정보가 없는지 확인하세요.