HANGUL SYLLABLE HAN
U+D55C · 이름 출처: 한글 규칙
- 코드포인트
- U+D55C
- 십진
- 54620
- 범주
- Lo · 기타 문자
- UTF-8
- ED 95 9C
- UTF-16
- D55C
- HTML
- 한
- CSS
- \d55c
- JS
- \uD55C
문자의 코드포인트·공식 이름·UTF-8 바이트를 알려줍니다. 코드나 이름으로도 문자를 찾을 수 있습니다.
HANGUL SYLLABLE HAN
U+D55C · 이름 출처: 한글 규칙
HANGUL SYLLABLE GEUL
U+AE00 · 이름 출처: 한글 규칙
SPACE
U+0020 · 이름 출처: 표
LATIN CAPITAL LETTER A
U+0041 · 이름 출처: 표
GRINNING FACE
U+1F600 · 이름 출처: 표
모든 문자에 매겨진 고유 번호입니다. U+ 뒤에 16진수로 씁니다. 예를 들어 "한"은 U+D55C, "A"는 U+0041입니다. 현재 U+0000부터 U+10FFFF까지 약 110만 자리가 있고 그중 15만 자 정도가 쓰이고 있습니다.
초성·중성·종성의 짧은 이름을 이어 붙입니다. "한"은 ㅎ(H)+ㅏ(A)+ㄴ(N)이라 HANGUL SYLLABLE HAN이 됩니다. 11,172자 모두 이 규칙으로 만들어지므로 표가 필요 없습니다. 한자도 CJK UNIFIED IDEOGRAPH-4E00처럼 코드포인트를 붙여 만듭니다.
UTF-16에서 두 단위(서로게이트 쌍)로 저장되기 때문입니다. 자바스크립트 문자열은 UTF-16 단위로 세므로 U+FFFF를 넘는 문자는 길이가 2가 됩니다. 문자열을 자를 때 이모지가 깨지는 것도 이 때문이고, Array.from()이나 for...of로 순회하면 코드포인트 단위로 셉니다.
코드포인트 크기에 따라 1~4바이트입니다. ASCII(U+0000~007F)는 1바이트, 라틴 확장과 그리스어 등은 2바이트, 한글과 한자는 3바이트, 이모지는 4바이트입니다. 한글이 영문보다 저장 공간을 세 배 쓰는 이유입니다.
전체 유니코드 자료가 4만 줄 2.2MB라 그대로 담으면 페이지가 무거워지기 때문입니다. 실제로 찾아볼 만한 5,600자만 담았습니다 — ASCII·라틴·그리스·키릴·한글 자모·문장부호·화살표·수학 기호·괘선·원문자·전각·이모지입니다. 문자나 코드로 찾는 것은 제한이 없습니다.
문자 인코딩 변환기(char-encoding)는 문자열 전체를 여러 인코딩으로 바꾸고, 이 도구는 문자 하나하나의 정보를 보여줍니다. 특정 글자가 왜 깨지는지 확인할 때 이 도구가 낫습니다.
마지막 검증: 2026년 8월 29일 · 결과는 참고용 추정치입니다.