전체 도구 ↗
💻 이 도구는 PC에서 더 편하게 쓸 수 있어요 · 코드 복사·붙여넣기 작업용
U+

유니코드 변환

문자↔유니코드를 변환합니다.

🔒 브라우저에서만 처리⚡ 입력하면 바로 변환설치·가입 없음
예시 채워보기

이 결과를 HTML 엔티티나 Base64로도 바꿔보고 싶다면 아래 관련 도구를 참고하세요.

💡 결과 카드를 캡처해 슬랙·노션에 붙이면 동료도 코드포인트를 바로 확인할 수 있어요.

광고

설명

문자를 입력하면 유니코드 코드포인트(U+XXXX)로, 코드포인트를 입력하면 다시 문자로 변환합니다. 결과는 글자별 카드로 표시되며, 카드를 누르면 그 코드포인트만 복사됩니다.

광고

관련 도구

유니코드 변환 도구는 입력한 문자를 유니코드 코드포인트(U+XXXX) 표기로 변환하거나, 반대로 코드포인트를 실제 문자로 되돌려주는 도구입니다. 웹 개발, 데이터 처리, 폰트 제작 등에서 특정 문자의 유니코드 값을 빠르게 확인해야 할 때 활용합니다. 브라우저에서 즉시 처리되므로 특수 문자나 이모지 코드값을 바로 얻을 수 있습니다.

사용 방법

입력칸 아래의 '문자 → 코드'와 '코드 → 문자' 두 버튼으로 변환 방향을 지정합니다. 문자를 입력하면 각 글자에 해당하는 U+XXXX 형식의 코드포인트가 나열되어 출력됩니다. 반대로 'U+AC00' 같은 코드포인트를 입력하고 '코드 → 문자'를 누르면 해당 문자('가')가 반환됩니다. 여러 글자를 한 번에 붙여 넣으면 글자 단위로 코드포인트를 모두 나열해 줍니다.

이럴 때 유용해요

HTML이나 CSS에서 특수 문자를 엔티티 코드로 사용해야 할 때 코드포인트를 먼저 확인하는 용도로 씁니다. Python, JavaScript 등 프로그래밍 언어에서 '\uXXXX' 이스케이프 시퀀스로 문자를 표현해야 할 때 정확한 코드값을 얻을 수 있습니다. 이모지나 특수 기호가 데이터베이스 또는 API 전송 중 깨지는 문제를 디버깅할 때, 해당 문자의 코드포인트를 확인해 인코딩 지원 범위를 점검하는 데 유용합니다.

알아두면 좋은 점

유니코드는 현재 17개 평면에 걸쳐 약 14만 개 이상의 문자를 정의하며, U+0000~U+FFFF 범위인 BMP(기본 다국어 평면)을 벗어나는 문자는 UTF-16 서로게이트 쌍으로 표현됩니다. 한글 완성형은 U+AC00(가)부터 U+D7A3(힣)까지 11,172자가 연속으로 배치되어 있습니다. 이모지 중 상당수는 BMP를 벗어난 U+1F600 이후 범위에 위치해 일부 구형 시스템에서 올바르게 처리되지 않을 수 있습니다.

자주 묻는 질문

유니코드 코드포인트와 UTF-8 바이트는 다른 건가요?
다릅니다. 코드포인트는 문자의 고유 번호(U+XXXX)이고, UTF-8은 그 번호를 실제 파일·네트워크에서 전송할 때 사용하는 바이트 인코딩 방식입니다. 예를 들어 '가'는 코드포인트 U+AC00이지만 UTF-8로 저장하면 3바이트(EA B0 80)입니다.
이모지도 코드포인트로 변환되나요?
네. 예를 들어 😀는 U+1F600으로 변환됩니다. BMP 범위를 벗어난 이모지는 코드포인트가 5자리 이상으로 표시됩니다.
한글 자모(ㄱ, ㅏ)와 완성형(가)은 코드포인트가 다른가요?
다릅니다. 자음 'ㄱ'은 U+3131, 모음 'ㅏ'는 U+314F이며, 완성형 '가'는 U+AC00입니다. 같은 한글이라도 입력 방식에 따라 코드포인트가 달라집니다.
코드포인트를 HTML 엔티티로 바꾸려면 어떻게 하나요?
U+AC00 형식의 코드포인트를 10진수로 바꾸면 44032이며, HTML에서는 가 또는 16진수로 가 형식으로 사용할 수 있습니다.
입력 문자 수에 제한이 있나요?
브라우저 안에서 처리하므로 입력 길이 제한은 따로 두지 않았습니다. 다만 화면이 무거워지지 않도록 결과 카드는 300개까지 먼저 보여주고 '더 보기'로 이어서 펼칠 수 있으며, 전체 결과는 카드 아래 원시 텍스트 칸에 그대로 담깁니다.

개인정보처리방침

유니코드 변환기 사용법

입력칸에 문자를 붙여넣으면 각 글자의 유니코드 코드포인트가 U+XXXX 형식으로 나열되고, 같은 입력칸에 U+AC00 같은 코드포인트(또는 AC00처럼 16진수만)를 넣고 '코드 → 문자'를 누르면 해당 문자로 되돌아갑니다. 입력을 멈추면 잠시 뒤 방향을 알아서 잡아 변환되고, 두 버튼으로 원하는 방향을 직접 지정할 수도 있습니다. 결과는 글자별 카드로 나오며 카드를 누르면 그 코드포인트만 복사되고, 카드 아래 원시 텍스트 칸에는 전체 결과가 한 줄로 담겨 그대로 복사할 수 있습니다. 예를 들어 "가"는 U+AC00, "A"는 U+0041, "€"는 U+20AC로 표시됩니다.

코드포인트가 매겨지는 원리

유니코드는 세상의 모든 문자에 고유 번호(코드포인트)를 하나씩 부여한 표입니다. 이 번호를 16진수로 적고 앞에 U+를 붙인 것이 표준 표기법입니다. 이 도구는 입력한 글자의 코드포인트를 읽어 16진수로 바꿔 보여주고, 역방향에서는 16진수를 다시 문자로 해석합니다.

문자코드포인트10진수
AU+004165
U+AC0044032
U+20AC8364
😀U+1F600128512

한글 완성형은 U+AC00(가)부터 U+D7A3(힣)까지 11,172자가 순서대로 배열돼 있어, "가"에 글자 수만큼 더하면 다음 음절의 코드포인트가 됩니다. 이모지처럼 U+FFFF를 넘는 문자는 다섯 자리(U+1F600) 이상으로 표기됩니다.

이럴 때 씁니다

눈으로 구분 안 되는 문자를 찾아낼 때 가장 유용합니다. 일반 공백(U+0020)과 줄바꿈 없는 공백(U+00A0), 붙어 보이는 제로폭 공백(U+200B)은 화면상 똑같아 보여도 코드포인트가 다릅니다. 복사한 텍스트가 자꾸 오류를 내면 이 도구에 넣어 숨은 문자를 잡아낼 수 있습니다. 또 소스코드에 유니코드 이스케이프(자바스크립트 \u0041, CSS content의 \0041, HTML의 A)를 직접 적어야 할 때 필요한 16진수 값을 확인하거나, 한글·특수문자·이모지의 정확한 코드포인트를 문서에 표기할 때도 씁니다.

활용 팁

U+FFFF를 넘는 이모지·희귀 한자는 하나의 코드포인트지만 자바스크립트 내부에서는 두 개의 16비트 조각(서로게이트 페어)으로 저장됩니다. 그래서 codePointAt으로 읽으면 U+1F600 하나로 나오지만 옛 방식(charCodeAt)으로는 U+D83D, U+DE00 두 개로 쪼개져 보입니다. 이 도구가 하나의 코드포인트로 묶어 보여주면 그 글자는 BMP(기본 다국어 평면) 바깥에 있다는 뜻입니다. 또 하나, 화면엔 한 글자로 보여도 코드포인트가 여러 개로 나온다면 결합 문자(예: 자모가 분리된 조합형 한글, 액센트가 분리된 é)일 수 있으니 정규화가 필요한지 점검하세요.

자주 묻는 질문

U+ 뒤의 숫자는 무슨 진법인가요?

16진수입니다. U+0041의 41은 10진수 65를 16진수로 적은 값이고, U+AC00은 10진수 44032입니다. 그래서 0~9 외에 A~F가 섞여 나옵니다.

이모지 하나가 왜 코드포인트 두세 개로 나오나요?

많은 이모지는 여러 코드포인트가 조합된 것입니다. 예를 들어 국기나 피부색·성별이 반영된 이모지는 기본 이모지에 변형 부호(U+FE0F)나 결합 문자(U+200D, ZWJ)가 이어 붙어 만들어지기 때문에, 한 글자처럼 보여도 코드포인트가 여러 개로 표시됩니다.

겉보기 같은 글자인데 코드포인트가 다른 경우가 있나요?

있습니다. 라틴 'A'(U+0041)와 키릴 'А'(U+0410), 그리스 'Α'(U+0391)는 모양이 거의 같지만 서로 다른 문자입니다. 검색이 안 되거나 비밀번호가 안 맞을 때 이런 혼입을 의심해볼 수 있습니다.

변환한 내용이 서버로 전송되나요?

아니요. 입력한 문자와 코드포인트 변환은 모두 브라우저 안에서만 이뤄지며 외부로 전송되지 않습니다.

자주 쓰신다면 Ctrl+D로 북마크해두세요