한글 깨짐 복구 — 깨진 글자 원래대로 되돌리기
인코딩을 잘못 읽어 깨진 글자를 인코딩 짝을 모두 시도해 복구하는 도구
브라우저에서 처리 · 서버로 전송되지 않음
예시로 UTF-8 한글을 Windows-1252로 잘못 읽은 글이 들어 있어요. 지우고 깨진 글을 붙여 넣으세요.
후보 2개, 가장 그럴듯한 후보: UTF-8로 저장된 글을 Windows-1252(Latin-1)로 읽음
가장 그럴듯한 후보
한글이 깨졌어요. 원래 문장으로 돌려 주세요.
UTF-8로 저장된 글을 Windows-1252(Latin-1)로 읽음
후보 2
챠�◑벭ぢ멤궗챙혶쨈 챗쨔짢챙징흸챙�벬늘�△��. 챙�봔먄ヅ알� 챘짭쨍챙탑짜챙흹쩌챘징흹 챘혧흸챘혻짚 챙짙쩌챙�왖맡�△��.
CP949(EUC-KR)로 저장된 글을 UTF-8로 읽음
이미 사라진 글자 11개는 �로 남겨 뒀어요.
UTF-8, CP949(EUC-KR), Shift_JIS, Windows-1252 네 인코딩의 모든 짝(12가지)을 거꾸로 되돌려 보고, 두 번 깨진 글은 한 번 더 되돌려 봐요. 후보는 흔한 한글 완성형(KS X 1001) 글자와 영문·숫자가 많을수록, �·제어 문자·Latin-1 기호가 적을수록 높게 매겨요. 인코딩 표는 WHATWG Encoding Standard를 따르고, 글은 브라우저 밖으로 나가지 않아요.
소개
깨진 한글 복구 도구는 인코딩이 맞지 않아 이상한 기호나 뜻 모를 한자로 바뀐 글을 원래 글자로 되돌려 줘요. 메일 제목이 “한글“로 보이거나, 오래된 게시판 글이 “媛먯궗�⑸땲��“처럼 보이거나, 일본어 사이트에서 가져온 글이 뒤죽박죽일 때 써 보세요. 어떤 인코딩끼리 엇갈렸는지 몰라도 괜찮아요. 가능한 조합을 모두 시도한 뒤 가장 자연스러운 결과를 위에서부터 보여 줘요.
사용법
- 깨진 글을 입력칸에 붙여 넣어요. 처음에는 예시로 깨진 글이 들어 있어요.
- 복구 후보에서 맨 위의 “가장 그럴듯한 후보”를 먼저 확인해요.
- 후보 아래에는 “UTF-8로 저장된 글을 Windows-1252로 읽음”처럼 어떻게 깨졌는지가 적혀 있어요. 같은 문제가 반복된다면 그 프로그램의 인코딩 설정을 바꾸면 돼요.
- 원하는 후보의 복사 버튼을 눌러 결과를 가져가요.
- 후보가 없거나 �가 많다면 원본 파일을 인코딩 변환기로 다시 열어 보세요.
기준
- 시도하는 인코딩: UTF-8, CP949(EUC-KR), Shift_JIS, Windows-1252(Latin-1). 네 개의 모든 짝, 12가지를 거꾸로 되돌려요. 깨진 글을 “잘못 읽은 인코딩”으로 다시 바이트로 바꾼 뒤 “원래 인코딩”으로 읽는 방식이에요.
- 첫 단계에서 글자를 잃지 않은 후보는 한 번 더 되돌려서 두 번 깨진 경우도 찾아요.
- 후보 순위는 흔한 한글 완성형(KS X 1001) 글자, 영문·숫자, 일본어 가나가 많을수록 높고, �, 제어 문자, Latin-1 기호, 드문 확장 한글이 많을수록 낮아요. 새로 �가 생긴 후보는 크게 감점해요.
- 입력의 20% 이상이 �이면 “글만으로는 되살릴 수 없다”는 안내와 인코딩 변환기 링크를 먼저 보여 줘요. 이때는 � 말고 남은 글자가 흔한 한글·가나로 또렷하게 읽히는 후보만 남기고, 무작위 기호처럼 보이는 결과는 후보로 내놓지 않아요.
- 인코딩 표는 WHATWG Encoding Standard를 따라요.
예시
| 깨진 글 | 깨진 이유 | 복구 결과 |
|---|---|---|
| 한글 | UTF-8을 Windows-1252로 읽음 | 한글 |
| À̸§ | CP949를 Windows-1252로 읽음 | 이름 |
| 媛먯궗�⑸땲�� | UTF-8을 CP949로 읽음 | 감사��니�� (일부만 복구, � 남음) |
| 譌・譛ャ隱槭� | UTF-8 일본어를 Shift_JIS로 읽음 | 日本語… (일부만 복구) |
| �ȳ��ϼ��� | CP949를 UTF-8로 읽음 | 복구 불가, 원본 파일 필요 (안내와 인코딩 변환기 링크 표시) |
엑셀에서 CSV 머리글이 “À̸§“처럼 보이는 경우가 두 번째 줄의 전형적인 예예요.
같은 프로그램에서 계속 글자가 깨진다면 복구보다 원인을 고치는 편이 좋아요. 후보 아래에 적힌 설명을 보고 그 프로그램의 저장 또는 열기 인코딩을 UTF-8로 맞추면 다음부터는 깨지지 않아요.
자주 묻는 질문
글자가 왜 깨지나요?
글자는 숫자(바이트)로 저장되는데, 저장할 때 쓴 인코딩과 읽을 때 쓴 인코딩이 다르면 같은 바이트가 엉뚱한 글자로 보여요. 예를 들어 UTF-8로 저장한 "한글"을 Windows-1252(Latin-1)로 읽으면 "한글"처럼 보여요.
어떤 경우에 복구가 안 되나요?
깨진 글에 �(물음표 다이아몬드)가 많으면 잘못 읽는 순간 원래 바이트가 버려진 거라서 글만으로는 완전히 되살릴 수 없어요. 특히 EUC-KR 파일을 UTF-8로 읽으면 거의 모든 한글이 �로 바뀌어요. 이럴 땐 원본 파일을 인코딩 변환기에서 CP949로 다시 여는 것이 가장 확실해요.
후보가 여러 개 나오면 어떤 걸 골라야 하나요?
맨 위 후보가 가장 그럴듯한 결과지만 짧은 글은 순위가 틀릴 수 있어요. 문장으로 자연스럽게 읽히는 후보를 고르고, 아래에 적힌 "어떤 인코딩으로 저장해서 어떤 인코딩으로 읽었는지" 설명을 참고하세요.
두 번 깨진 글도 복구되나요?
네. 깨진 글을 다시 저장하고 또 잘못 읽은 경우(예: 한가 Õœ로 바뀐 경우)까지 두 단계로 되돌려 봐요. 5,000자가 넘는 글은 시간이 오래 걸려 한 단계만 시도해요.
짧은 일본어나 한두 글자는 왜 복구가 잘 안 되나요?
순위는 글자가 얼마나 자연스러워 보이는지로 매기는데, 아주 짧은 글은 깨진 글 자체도 한자와 가나가 섞여 그럴듯해 보일 수 있어요. 예를 들어 "ありがとう"가 Shift_JIS로 깨진 "縺ゅj縺後→縺�"는 후보가 나오지 않거나 순위가 바뀔 수 있어요. 문장이 길수록 정확해지니 가능하면 앞뒤 문장까지 함께 붙여 넣으세요.
붙여 넣은 글이 저장되나요?
아니요. 모든 계산은 브라우저 안에서 이루어지고 글은 어디에도 보내지 않아요.