← 가이드

TOOLDAM GUIDE

CSV를 열었을 때 한글이 깨지는 이유와 확인 방법

CSV를 만든 프로그램과 여는 프로그램이 서로 다른 문자 인코딩을 사용하면 한글이 깨질 수 있습니다. UTF-8과 BOM 여부가 대표적인 확인 지점입니다.

먼저 알아둘 점

CSV에는 글자 인코딩 정보가 명확하게 전달되지 않는 경우가 있어, 파일을 만든 프로그램과 여는 프로그램이 서로 다른 인코딩을 가정하면 한글이 깨질 수 있습니다.

CSV는 표 구조와 문자 인코딩이 별개의 문제입니다

쉼표로 열을 구분하는 규칙이 맞더라도 각 바이트를 어떤 문자로 읽을지는 별도 문제입니다. UTF-8 파일을 다른 문자셋으로 해석하면 한글이 물음표나 의미 없는 문자로 보일 수 있습니다.

UTF-8인데도 프로그램마다 결과가 다른 이유

일부 프로그램은 파일 시작의 BOM 유무나 운영체제의 기본 문자셋을 참고해 인코딩을 추정합니다. 그래서 같은 CSV도 브라우저, 텍스트 편집기, 스프레드시트 프로그램에서 다르게 열릴 수 있습니다.

깨졌을 때 원본을 바로 덮어쓰지 마세요

깨진 상태로 다시 저장하면 원래 바이트 정보까지 바뀌어 복구가 더 어려워질 수 있습니다. 먼저 복사본으로 인코딩을 바꿔 열어보고 올바른 글자가 보이는지 확인하세요.

  • 파일을 만든 프로그램에서 사용한 인코딩 확인
  • UTF-8로 다시 가져오기 시도
  • 구분자도 함께 확인
  • 선행 0과 날짜 자동 변환 확인

상대방에게 전달할 파일이라면 환경을 고려합니다

웹 시스템 간 데이터 교환에는 UTF-8이 일반적이지만, 특정 업무 프로그램이 별도 인코딩을 요구할 수 있습니다. 상대 시스템의 가져오기 규칙이 있다면 그 규칙을 우선해야 합니다.