깨진 한글을 다시 읽을 수 있게 되돌리기

메일·옛 게시판·CSV·압축 파일 이름에서 안녕처럼 이상하게 보이는 글을 붙여 넣으면, UTF-8이나 EUC-KR을 잘못 읽었을 때 흔한 경로로 복구 후보를 보여 줍니다. 처리는 이 기기 브라우저에서만 이뤄지며 서버로 보내지 않습니다.

24자 · 복구 후보 2개 · 추천: UTF-8을 Latin-1처럼 읽은 경우

추천 · UTF-8을 Latin-1처럼 읽은 경우

메일·구형 웹·CSV에서 가장 흔한 패턴입니다.

안녕하세요 Gongbaek

EUC-KR/CP949를 Latin-1처럼 읽은 경우

옛 게시판·일부 공공·사내 시스템에서 자주 보입니다.

�•ˆ�…•�•˜�„몄š” Gongbaek

깨진 한글은 왜 생기나요?

글자는 바이트로 저장되고, “이 바이트를 어떤 규칙으로 읽을지”가 인코딩입니다. 저장할 때와 열 때의 규칙이 다르면, 같은 파일인데도 안녕 같은 서유럽 문자 나열이나, 네모·물음표로 바뀝니다. 한국에서는 예전에 EUC-KR / CP949(Windows-949)가 많이 쓰였고, 지금은 UTF-8이 기본이라, 두 규칙이 섞인 메일·첨부·CSV에서 자주 만납니다.

중요한 점: 화면에 이미 �로 바뀐 자리는 원본 바이트가 사라진 경우가 많아, 웹 도구만으로 완벽히 되돌리기 어렵습니다. 그런 때는 원본 파일을 메모장·엑셀에서 인코딩을 바꿔 다시 여는 편이 낫습니다.

이런 상황에서 자주 씁니다

  • 해외 메일 클라이언트가 한글 본문·제목을 이상하게 보여줄 때
  • 구형 카페·게시판·사내 게시에서 복사한 글이 서유럽 문자로 보일 때
  • CSV를 엑셀에서 열었더니 이름이 깨져, 셀 내용을 복사해 온 경우
  • 압축 파일·폴더 이름이 깨진 채 채팅으로 전달된 경우
  • 로그·덤프에 남은 깨진 문자열만 있고, 원본 파일을 당장 못 찾을 때

이렇게 쓰세요

  1. 깨져 보이는 구간만, 또는 통째로 위에 붙여넣습니다.
  2. 위에 올라온 후보 중 한글이 자연스러운 결과를 고릅니다. 첫 줄이 보통 추천입니다.
  3. 복사해 문서·시트·메일에 다시 붙입니다.
  4. 후보가 없거나 여전히 이상하면, 원본 파일을 UTF-8 / 한국어(CP949)로 각각 열어 비교하세요. 안 보이는 공백까지 의심되면 숨은 문자 표시도 함께 쓰면 됩니다.

이 도구가 하는 일 · 하지 않는 일

하는 일: 화면에 보이는 문자를 “잘못된 인코딩으로 읽힌 Latin-1 바이트”로 가정한 뒤, UTF-8·EUC-KR·Windows-949로 다시 읽어 후보를 만듭니다. 이중 UTF-8 오인이나 NFC 정규화도 시도합니다.

하지 않는 일: 파일이 통째로 사라졌을 때 추측으로 문장을 지어내지 않습니다. AI로 “그럴듯한 한글”을 만들어 주지도 않습니다. 복구 불가면 그 사실을 알려 드리고, 파일 쪽 재오픈을 안내합니다.

브라우저가 EUC-KR 디코더를 지원하지 않으면 해당 후보는 목록에 안 나올 수 있습니다. Chrome 계열에서는 대체로 동작합니다.

복구가 안 될 때 점검 순서

  1. 원본 파일(또는 메일 원문)이 남아 있는지 확인합니다. 화면 캡처만 있으면 복구가 어렵습니다.
  2. 윈도우 메모장에서 “다른 인코딩으로 열기”로 UTF-8과 한국어를 번갈아 봅니다.
  3. 엑셀 CSV는 “데이터 → 텍스트/CSV에서”로 열어 인코딩을 지정하는 편이, 더블클릭 후 복사하는 것보다 안전합니다. 붙여넣기 전 정리는 엑셀 붙여넣기 전 정리에도 적어 두었습니다.
  4. 글자는 정상인데 검색·비교만 안 되면 인코딩이 아니라 정규화·숨은 문자 문제일 수 있습니다. 유니코드 정규화·두 닉 비교를 쓰면 됩니다.

공백·특문 문제와는 어떻게 다른가요?

투명 공백·제로폭은 “안 보이는데 자리를 차지하는” 문자입니다. 한글 깨짐은 “보이긴 하는데 엉뚱한 글자로 읽히는” 문제입니다. 채용 폼·카페가 특수문자를 거부할 때는 깨짐 복구가 아니라 숨은 문자·이모지 정리가 먼저인 경우가 많습니다. 안 보이는 문자만 지우려면 안 보이는 문자 제거를, 폼 제출이 막힐 때는 특수문자 불가 폼 정리를 보면 됩니다.

자주 묻는 질문

첫 후보가 항상 맞나요?
아닙니다. 한글 음절이 많이 보이는 쪽을 앞에 둘 뿐입니다. 짧은 고유명사·코드가 섞이면 두 번째 후보가 맞을 수도 있으니 눈으로 한 번 확인하세요.
영문·숫자만 있는 로그도 되나요?
시도는 하지만, 한글이 없다면 “복구됐다”고 보기 어렵습니다. 한글이 깨진 구간에 초점을 두는 도구입니다.
개인정보가 서버에 남나요?
아니요. 변환은 사용 중인 기기 브라우저에서만 수행됩니다. 주민번호·연락처가 포함된 텍스트도 업로드하지 않습니다.
EUC-KR과 UTF-8 중 뭐가 더 흔한가요?
웹·최신 메일은 UTF-8 오인이 많고, 오래된 사내 자료·일부 공공 첨부·옛 커뮤니티는 EUC-KR/CP949 쪽을 의심하면 됩니다. 후보 목록에 둘 다 나오면 문맥에 맞는 쪽을 고르면 됩니다.

사용자 의견 · 질문

이 페이지에 대한 사용 경험, 버그 신고, 기능 제안을 남겨주세요. 익명으로 작성 가능하고, 관리자 승인 후 공개됩니다.

전체 사이트 의견 모아보기 →

아직 댓글이 없습니다

댓글