유니코드 변환
문자↔유니코드를 변환합니다.
위 입력칸에 문자를 넣으면 각 글자의 코드포인트가 카드로 나타나요.
이 결과를 HTML 엔티티나 Base64로도 바꿔보고 싶다면 아래 관련 도구를 참고하세요.
💡 결과 카드를 캡처해 슬랙·노션에 붙이면 동료도 코드포인트를 바로 확인할 수 있어요.
설명
문자를 입력하면 유니코드 코드포인트(U+XXXX)로, 코드포인트를 입력하면 다시 문자로 변환합니다. 결과는 글자별 카드로 표시되며, 카드를 누르면 그 코드포인트만 복사됩니다.
관련 도구
유니코드 변환 도구는 입력한 문자를 유니코드 코드포인트(U+XXXX) 표기로 변환하거나, 반대로 코드포인트를 실제 문자로 되돌려주는 도구입니다. 웹 개발, 데이터 처리, 폰트 제작 등에서 특정 문자의 유니코드 값을 빠르게 확인해야 할 때 활용합니다. 브라우저에서 즉시 처리되므로 특수 문자나 이모지 코드값을 바로 얻을 수 있습니다.
사용 방법
입력칸 아래의 '문자 → 코드'와 '코드 → 문자' 두 버튼으로 변환 방향을 지정합니다. 문자를 입력하면 각 글자에 해당하는 U+XXXX 형식의 코드포인트가 나열되어 출력됩니다. 반대로 'U+AC00' 같은 코드포인트를 입력하고 '코드 → 문자'를 누르면 해당 문자('가')가 반환됩니다. 여러 글자를 한 번에 붙여 넣으면 글자 단위로 코드포인트를 모두 나열해 줍니다.
이럴 때 유용해요
HTML이나 CSS에서 특수 문자를 엔티티 코드로 사용해야 할 때 코드포인트를 먼저 확인하는 용도로 씁니다. Python, JavaScript 등 프로그래밍 언어에서 '\uXXXX' 이스케이프 시퀀스로 문자를 표현해야 할 때 정확한 코드값을 얻을 수 있습니다. 이모지나 특수 기호가 데이터베이스 또는 API 전송 중 깨지는 문제를 디버깅할 때, 해당 문자의 코드포인트를 확인해 인코딩 지원 범위를 점검하는 데 유용합니다.
알아두면 좋은 점
유니코드는 현재 17개 평면에 걸쳐 약 14만 개 이상의 문자를 정의하며, U+0000~U+FFFF 범위인 BMP(기본 다국어 평면)을 벗어나는 문자는 UTF-16 서로게이트 쌍으로 표현됩니다. 한글 완성형은 U+AC00(가)부터 U+D7A3(힣)까지 11,172자가 연속으로 배치되어 있습니다. 이모지 중 상당수는 BMP를 벗어난 U+1F600 이후 범위에 위치해 일부 구형 시스템에서 올바르게 처리되지 않을 수 있습니다.
자주 묻는 질문
유니코드 코드포인트와 UTF-8 바이트는 다른 건가요?
이모지도 코드포인트로 변환되나요?
한글 자모(ㄱ, ㅏ)와 완성형(가)은 코드포인트가 다른가요?
코드포인트를 HTML 엔티티로 바꾸려면 어떻게 하나요?
입력 문자 수에 제한이 있나요?
개인정보처리방침
모든 처리는 브라우저 내부에서만 수행되며 입력값·파일은 서버로 전송·저장되지 않습니다. 광고: Google AdSense(쿠키 사용 가능, 설정). 문의 kjh920424@gmail.com
유니코드 변환기 사용법
입력칸에 문자를 붙여넣으면 각 글자의 유니코드 코드포인트가 U+XXXX 형식으로 나열되고, 같은 입력칸에 U+AC00 같은 코드포인트(또는 AC00처럼 16진수만)를 넣고 '코드 → 문자'를 누르면 해당 문자로 되돌아갑니다. 입력을 멈추면 잠시 뒤 방향을 알아서 잡아 변환되고, 두 버튼으로 원하는 방향을 직접 지정할 수도 있습니다. 결과는 글자별 카드로 나오며 카드를 누르면 그 코드포인트만 복사되고, 카드 아래 원시 텍스트 칸에는 전체 결과가 한 줄로 담겨 그대로 복사할 수 있습니다. 예를 들어 "가"는 U+AC00, "A"는 U+0041, "€"는 U+20AC로 표시됩니다.
코드포인트가 매겨지는 원리
유니코드는 세상의 모든 문자에 고유 번호(코드포인트)를 하나씩 부여한 표입니다. 이 번호를 16진수로 적고 앞에 U+를 붙인 것이 표준 표기법입니다. 이 도구는 입력한 글자의 코드포인트를 읽어 16진수로 바꿔 보여주고, 역방향에서는 16진수를 다시 문자로 해석합니다.
| 문자 | 코드포인트 | 10진수 |
|---|---|---|
| A | U+0041 | 65 |
| 가 | U+AC00 | 44032 |
| € | U+20AC | 8364 |
| 😀 | U+1F600 | 128512 |
한글 완성형은 U+AC00(가)부터 U+D7A3(힣)까지 11,172자가 순서대로 배열돼 있어, "가"에 글자 수만큼 더하면 다음 음절의 코드포인트가 됩니다. 이모지처럼 U+FFFF를 넘는 문자는 다섯 자리(U+1F600) 이상으로 표기됩니다.
이럴 때 씁니다
눈으로 구분 안 되는 문자를 찾아낼 때 가장 유용합니다. 일반 공백(U+0020)과 줄바꿈 없는 공백(U+00A0), 붙어 보이는 제로폭 공백(U+200B)은 화면상 똑같아 보여도 코드포인트가 다릅니다. 복사한 텍스트가 자꾸 오류를 내면 이 도구에 넣어 숨은 문자를 잡아낼 수 있습니다. 또 소스코드에 유니코드 이스케이프(자바스크립트 \u0041, CSS content의 \0041, HTML의 A)를 직접 적어야 할 때 필요한 16진수 값을 확인하거나, 한글·특수문자·이모지의 정확한 코드포인트를 문서에 표기할 때도 씁니다.
활용 팁
U+FFFF를 넘는 이모지·희귀 한자는 하나의 코드포인트지만 자바스크립트 내부에서는 두 개의 16비트 조각(서로게이트 페어)으로 저장됩니다. 그래서 codePointAt으로 읽으면 U+1F600 하나로 나오지만 옛 방식(charCodeAt)으로는 U+D83D, U+DE00 두 개로 쪼개져 보입니다. 이 도구가 하나의 코드포인트로 묶어 보여주면 그 글자는 BMP(기본 다국어 평면) 바깥에 있다는 뜻입니다. 또 하나, 화면엔 한 글자로 보여도 코드포인트가 여러 개로 나온다면 결합 문자(예: 자모가 분리된 조합형 한글, 액센트가 분리된 é)일 수 있으니 정규화가 필요한지 점검하세요.
자주 묻는 질문
U+ 뒤의 숫자는 무슨 진법인가요?
16진수입니다. U+0041의 41은 10진수 65를 16진수로 적은 값이고, U+AC00은 10진수 44032입니다. 그래서 0~9 외에 A~F가 섞여 나옵니다.
이모지 하나가 왜 코드포인트 두세 개로 나오나요?
많은 이모지는 여러 코드포인트가 조합된 것입니다. 예를 들어 국기나 피부색·성별이 반영된 이모지는 기본 이모지에 변형 부호(U+FE0F)나 결합 문자(U+200D, ZWJ)가 이어 붙어 만들어지기 때문에, 한 글자처럼 보여도 코드포인트가 여러 개로 표시됩니다.
겉보기 같은 글자인데 코드포인트가 다른 경우가 있나요?
있습니다. 라틴 'A'(U+0041)와 키릴 'А'(U+0410), 그리스 'Α'(U+0391)는 모양이 거의 같지만 서로 다른 문자입니다. 검색이 안 되거나 비밀번호가 안 맞을 때 이런 혼입을 의심해볼 수 있습니다.
변환한 내용이 서버로 전송되나요?
아니요. 입력한 문자와 코드포인트 변환은 모두 브라우저 안에서만 이뤄지며 외부로 전송되지 않습니다.
자주 쓰신다면 Ctrl+D로 북마크해두세요