도구스개발

유니코드 문자 정보 조회

문자의 코드포인트·공식 이름·UTF-8 바이트를 알려줍니다. 코드나 이름으로도 문자를 찾을 수 있습니다.

HANGUL SYLLABLE HAN

U+D55C · 이름 출처: 한글 규칙

코드포인트
U+D55C
십진
54620
범주
Lo · 기타 문자
UTF-8
ED 95 9C
UTF-16
D55C
HTML
한
CSS
\d55c
JS
\uD55C

HANGUL SYLLABLE GEUL

U+AE00 · 이름 출처: 한글 규칙

코드포인트
U+AE00
십진
44544
범주
Lo · 기타 문자
UTF-8
EA B8 80
UTF-16
AE00
HTML
글
CSS
\ae00
JS
\uAE00

SPACE

U+0020 · 이름 출처:

코드포인트
U+0020
십진
32
범주
Zs · 공백
UTF-8
20
UTF-16
0020
HTML
 
CSS
\0020
JS
\u0020
A

LATIN CAPITAL LETTER A

U+0041 · 이름 출처:

코드포인트
U+0041
십진
65
범주
Lu · 대문자
UTF-8
41
UTF-16
0041
HTML
A
CSS
\0041
JS
\u0041
😀

GRINNING FACE

U+1F600 · 이름 출처:

코드포인트
U+1F600
십진
128512
범주
So · 기타 기호
UTF-8
F0 9F 98 80
UTF-16
D83D DE00
HTML
😀
CSS
\1f600
JS
\u{1F600}
한글과 한자는 이름이 규칙으로 정해집니다. 한글 음절 11,172자는 초성·중성·종성의 짧은 이름을 이어 붙여 만듭니다 — “한”은 HANGUL SYLLABLE HAN 입니다. 한자는 코드포인트를 붙여 CJK UNIFIED IDEOGRAPH-4E00 처럼 됩니다. 표에 넣지 않고 계산으로 만들기 때문에 이 도구가 가볍습니다.
이모지는 글자 하나가 아닙니다. UTF-16 에서 두 단위(서로게이트 쌍)로 저장되어 자바스크립트에서 length 가 2로 나옵니다. 그래서 문자열을 자를 때 이모지가 깨집니다. 이 도구는 코드포인트 단위로 세므로 하나로 셉니다.
이름 검색은 표에 담긴 5,600자 안에서만 됩니다. ASCII·라틴·그리스· 키릴·한글 자모·문장부호·화살표·수학 기호·괘선·원문자·전각·이모지를 담았습니다. 문자나 코드로 찾는 것은 범위 제한이 없습니다.

사용 방법

  1. 1문자를 붙여넣으면 하나씩 분석합니다.
  2. 2코드포인트를 알면 U+AC00 형태로 넣어 문자를 확인합니다.
  3. 3이름 일부로도 찾을 수 있습니다(예: ARROW, HEART).

자주 묻는 질문

모든 문자에 매겨진 고유 번호입니다. U+ 뒤에 16진수로 씁니다. 예를 들어 "한"은 U+D55C, "A"는 U+0041입니다. 현재 U+0000부터 U+10FFFF까지 약 110만 자리가 있고 그중 15만 자 정도가 쓰이고 있습니다.

초성·중성·종성의 짧은 이름을 이어 붙입니다. "한"은 ㅎ(H)+ㅏ(A)+ㄴ(N)이라 HANGUL SYLLABLE HAN이 됩니다. 11,172자 모두 이 규칙으로 만들어지므로 표가 필요 없습니다. 한자도 CJK UNIFIED IDEOGRAPH-4E00처럼 코드포인트를 붙여 만듭니다.

UTF-16에서 두 단위(서로게이트 쌍)로 저장되기 때문입니다. 자바스크립트 문자열은 UTF-16 단위로 세므로 U+FFFF를 넘는 문자는 길이가 2가 됩니다. 문자열을 자를 때 이모지가 깨지는 것도 이 때문이고, Array.from()이나 for...of로 순회하면 코드포인트 단위로 셉니다.

코드포인트 크기에 따라 1~4바이트입니다. ASCII(U+0000~007F)는 1바이트, 라틴 확장과 그리스어 등은 2바이트, 한글과 한자는 3바이트, 이모지는 4바이트입니다. 한글이 영문보다 저장 공간을 세 배 쓰는 이유입니다.

전체 유니코드 자료가 4만 줄 2.2MB라 그대로 담으면 페이지가 무거워지기 때문입니다. 실제로 찾아볼 만한 5,600자만 담았습니다 — ASCII·라틴·그리스·키릴·한글 자모·문장부호·화살표·수학 기호·괘선·원문자·전각·이모지입니다. 문자나 코드로 찾는 것은 제한이 없습니다.

문자 인코딩 변환기(char-encoding)는 문자열 전체를 여러 인코딩으로 바꾸고, 이 도구는 문자 하나하나의 정보를 보여줍니다. 특정 글자가 왜 깨지는지 확인할 때 이 도구가 낫습니다.

알아두면 좋은 점

  • unicode.org의 UnicodeData.txt 최신판에서 5,600자를 추려 담았습니다(2026-08-29 받음).
  • 한글 음절과 한자는 표 대신 표준 규칙으로 이름을 만들어 냅니다.
  • 이름 검색은 담긴 5,600자 안에서만 됩니다. 문자·코드 조회는 범위 제한이 없습니다.

함께 보면 좋은 도구

마지막 검증: 2026년 8월 29일 · 결과는 참고용 추정치입니다.