한국어

EUC-KR UTF-8 변환 — CP949·Shift_JIS 인코딩 변환기

EUC-KR·CP949·UTF-8·Shift_JIS·UTF-16 사이에서 글과 파일의 문자 인코딩을 바꾸는 도구

브라우저에서 처리 · 서버로 전송되지 않음

입력 방식

바꿀 수 없는 글자

CP949 (EUC-KR 확장 완성형)로 73 B

앞부분 바이트(16진수)

BE C8 B3 E7 C7 CF BC BC BF E4 2E 20 C7 D1 B1 DB 20 C0 CE C4 DA B5 F9 20 BA AF C8 AF 20 BF B9 BD C3 BF B9 BF E4 2E 0A C0 CC B8 A7 2C C0 FC C8 AD …

인코딩 표는 WHATWG Encoding Standard를 따라요(브라우저가 euc-kr·shift_jis를 읽는 방식과 같아요). 브라우저에서 EUC-KR은 CP949(통합형 한글 8,822자 확장)로 다뤄지고, "EUC-KR (KS X 1001 글자만)"을 고르면 완성형 2,350자 밖의 한글(똠, 뷁 등)은 바꿀 수 없는 글자로 처리해요. 모든 변환은 브라우저 안에서만 이루어져요.

소개

인코딩 변환기는 같은 한글이 프로그램마다 깨져 보이는 문제를 해결하는 도구예요. 공공기관이나 오래된 프로그램에서 내려받은 CSV는 EUC-KR(CP949)로 저장된 경우가 많아서 요즘 프로그램이나 웹에서 열면 글자가 이상한 기호로 보여요. 반대로 UTF-8로 만든 파일을 옛 시스템에 올리면 그쪽에서 깨지기도 하죠. 이 도구에 파일을 열거나 글을 붙여 넣고 바꿀 인코딩만 고르면, 같은 내용을 원하는 인코딩의 파일로 바로 받을 수 있어요.

사용법

  1. 입력 방식에서 “글 붙여 넣기” 또는 “파일 열기”를 골라요.
  2. 파일을 열었다면 원본 인코딩은 “자동 감지”로 두고 미리보기를 확인해요. 한글이 깨져 보이면 원본 인코딩을 직접 바꿔 봐요.
  3. 바꿀 인코딩을 골라요. UTF-8이나 UTF-16을 고르면 BOM을 붙일지 정할 수 있고, CP949·EUC-KR·Shift_JIS를 고르면 표현할 수 없는 글자를 어떻게 바꿀지 정할 수 있어요.
  4. 결과의 크기와 앞부분 바이트(16진수)를 확인한 뒤 “변환한 파일 받기”를 눌러요. 파일 이름 뒤에 -utf8, -cp949 같은 표시가 붙어요.

기준

  • 인코딩 표는 WHATWG Encoding Standard를 따라요. 브라우저가 euc-kr, shift_jis라는 이름의 파일을 읽을 때와 같은 규칙이에요.
  • CP949는 KS X 1001 완성형 2,350자에 나머지 한글 8,822자를 더해 현대 한글 11,172자를 모두 담아요. “EUC-KR (KS X 1001 글자만)“을 고르면 완성형에 없는 글자(예: 똠, 뷁)는 바꿀 수 없는 글자로 표시해요.
  • 자동 감지는 BOM이 있으면 그것을 따르고, 없으면 UTF-8로 올바르게 읽히는지 먼저 본 뒤 CP949·Shift_JIS·Windows-1252 가운데 가장 자연스럽게 읽히는 것을 골라요.
  • 파일은 20MB까지 열 수 있어요.

예시

원본 바꿀 인코딩 결과
한글 CP949 C7 D1 B1 DB (4바이트)
한글 UTF-8 ED 95 9C EA B8 80 (6바이트)
가 UTF-8 + BOM EF BB BF EA B0 80
똠 EUC-KR (KS X 1001) 바꿀 수 없음 → ?
똠 CP949 8C 63

한글 한 글자는 CP949에서 2바이트, UTF-8에서 3바이트예요. 그래서 같은 글이라도 UTF-8 파일이 더 커요.

자주 묻는 질문

EUC-KR과 CP949는 다른 건가요?

EUC-KR은 KS X 1001 완성형 한글 2,350자만 담는 인코딩이고, CP949는 마이크로소프트가 여기에 나머지 한글 8,822자를 더한 확장판이에요. 브라우저와 윈도우는 "EUC-KR"이라는 이름으로 CP949를 쓰는 경우가 많아요. 받는 쪽 시스템이 옛 EUC-KR만 받는다면 "EUC-KR (KS X 1001 글자만)"을 골라 표현할 수 없는 글자가 있는지 확인하세요.

엑셀에서 UTF-8 CSV를 열면 한글이 깨져요.

엑셀은 BOM이 없는 UTF-8 CSV를 한국어 윈도우에서 CP949로 읽기도 해요. 바꿀 인코딩을 UTF-8로 두고 "BOM 붙이기"를 켜서 받으면 대부분 바로 열려요. 오래된 프로그램에 넣어야 한다면 CP949로 바꿔서 받으세요.

바꿀 수 없는 글자는 어떻게 되나요?

이모지나 일부 한자처럼 대상 인코딩에 없는 글자는 물음표(?)나 &#번호; 형태의 HTML 숫자 참조로 바꿀 수 있어요. 어떤 글자가 바뀌었는지 결과 아래에 목록으로 보여 줘요.

자동 감지가 틀리면 어떻게 하나요?

원본 인코딩을 직접 골라 보세요. 미리보기가 정상 한글로 보이고 �가 없으면 맞게 고른 거예요. 짧은 파일은 CP949와 Shift_JIS가 모두 그럴듯하게 읽혀 자동 감지가 헷갈릴 수 있어요.

파일이 서버로 올라가나요?

아니요. 파일 읽기, 인코딩 판별, 변환과 내려받기까지 모두 브라우저 안에서 이루어지고 어디에도 저장되지 않아요.

필요한 도구가 있나요?