본문 바로가기
모든 이야기 모든 이야기

CSV 파일을 엑셀에서 열었을 때 한글이 깨지는 원인과 파워쿼리 불러오기 해결법 (신규 추가)

읽는 시간 약 7분

CSV 파일을 열 때 한글이 깨지는 이유와 근본적인 해결책

업무를 하다 보면 외부 시스템에서 데이터를 내려받거나 다른 사람에게 공유받은 CSV 파일을 엑셀로 열었을 때, 한글이 알 수 없는 외계어나 특수문자로 깨져 보이는 경험을 한 번쯤 해보셨을 겁니다. 이는 단순히 엑셀의 오류가 아니라, 컴퓨터가 텍스트를 읽어 들이는 방식인 ‘인코딩’ 체계가 서로 맞지 않기 때문에 발생하는 현상입니다.

CSV(Comma Separated Values) 파일은 서식이 없는 순수 텍스트 파일입니다. 이 텍스트를 저장할 때 어떤 언어 체계(인코딩 방식)를 사용했느냐가 중요한데, 윈도우 환경의 엑셀은 기본적으로 ‘CP949’ 또는 ‘EUC-KR’이라는 한국어 완성형 인코딩을 기준으로 파일을 읽으려 합니다. 하지만 최근 대부분의 웹 서비스나 데이터 추출 도구는 전 세계 어디서나 통용되는 ‘UTF-8’ 방식을 기본값으로 사용합니다. 이처럼 읽는 방식과 쓰는 방식의 차이 때문에 발생하는 간극이 바로 한글 깨짐의 핵심 원인입니다.

파워쿼리를 활용한 완벽한 데이터 불러오기 방법

과거에는 메모장으로 파일을 열어 다시 인코딩을 변경하고 저장하는 번거로운 방식을 사용했습니다. 하지만 이제는 엑셀에 내장된 ‘파워쿼리’ 기능을 활용하면 데이터를 원본 그대로 유지하면서도 아주 깔끔하게 불러올 수 있습니다. 파워쿼리는 데이터의 변환과 정제에 최적화된 도구로, 한 번 설정해두면 다음부터는 클릭 몇 번으로 동일한 작업을 자동화할 수 있습니다.

    • 엑셀 상단 메뉴에서 데이터 탭을 클릭합니다.
    • 텍스트/CSV에서 버튼을 눌러 불러오고자 하는 파일을 선택합니다.
    • 파일 가져오기 창이 뜨면 가장 중요한 ‘파일 원본’ 항목을 확인합니다.
    • 파일 원본 드롭다운 목록에서 65001: 유니코드(UTF-8) 항목을 선택합니다.
    • 미리보기 창에서 한글이 정상적으로 나타나는지 확인한 후 로드 버튼을 누릅니다.

이 방법을 사용하면 엑셀이 파일을 열기 전에 해당 파일이 어떤 인코딩으로 작성되었는지 명확히 인지하게 됩니다. 파워쿼리를 사용하면 단순히 글자가 깨지는 문제를 해결할 뿐만 아니라, 데이터 형식을 미리 지정하거나 불필요한 열을 삭제하는 등 전처리 과정까지 동시에 진행할 수 있어 업무 효율을 극대화할 수 있습니다.

인코딩 방식의 종류와 특성 이해하기

데이터를 다루다 보면 접하게 되는 인코딩 방식은 크게 몇 가지로 나뉩니다. 각 방식의 특성을 알면 왜 내 파일이 깨지는지 더 쉽게 이해할 수 있습니다.

    • UTF-8: 전 세계 모든 언어를 표현할 수 있는 표준 인코딩 방식입니다. 현대의 웹 환경과 오픈소스 데이터에서 가장 널리 사용됩니다.
    • CP949 또는 EUC-KR: 과거 한국의 윈도우 환경에서 표준으로 사용하던 방식입니다. 영문과 한글은 잘 표현하지만, 다른 국가의 언어나 특수문자 처리에 한계가 있습니다.
    • UTF-8 BOM: UTF-8 방식이지만 파일의 맨 앞에 ‘이 파일은 UTF-8입니다’라는 표시를 해둔 형태입니다. 엑셀은 가끔 이 표시가 없으면 파일을 제대로 인식하지 못하는 경우가 있습니다.

많은 분이 흔히 오해하는 것 중 하나가 ‘파일 자체가 손상되었다’고 생각하는 것입니다. 하지만 한글이 깨지는 것은 파일이 파괴된 것이 아니라, 해석하는 렌즈가 잘못 설정된 것일 뿐입니다. 데이터의 내용은 그대로 보존되어 있으니 안심하고 인코딩 설정만 변경해주면 됩니다.

파워쿼리 사용이 가져오는 업무적 이점

파워쿼리는 단순히 한글 깨짐을 해결하는 도구를 넘어, 데이터 관리의 수준을 한 단계 높여줍니다. 파워쿼리를 사용해야 하는 이유는 다음과 같습니다.

  • 반복 작업의 자동화: 매주 같은 형식의 CSV 파일을 받아야 한다면, 파워쿼리로 한 번 설정해둔 쿼리를 ‘새로 고침’하는 것만으로도 즉시 업데이트가 완료됩니다.
  • 데이터 무결성 유지: 파일을 직접 열어서 수정하고 저장하는 과정에서 실수로 데이터가 지워지거나 서식이 꼬일 위험이 없습니다. 파워쿼리는 원본 파일을 건드리지 않고 읽기 전용으로 데이터를 가져오기 때문입니다.
  • 대용량 처리 가능: 수만 행 이상의 데이터를 일반적인 방법으로 열면 엑셀이 멈추거나 느려질 수 있지만, 파워쿼리는 데이터를 효율적으로 로드하여 성능 저하를 최소화합니다.

전문가가 제안하는 데이터 관리 팁

데이터 분석가들은 항상 데이터의 ‘출처’와 ‘형식’을 먼저 확인하라고 조언합니다. CSV 파일을 생성하는 시스템이 어디인지, 그리고 그 시스템이 어떤 인코딩을 지원하는지 알면 파일 하나하나를 수정할 필요가 없습니다. 만약 본인이 직접 CSV 파일을 생성하여 배포하는 입장이라면, 가급적 ‘UTF-8(BOM 포함)’ 방식으로 저장하는 것을 추천합니다. 이렇게 하면 엑셀에서 파일을 더블 클릭했을 때 별도의 설정 없이도 한글이 올바르게 표시됩니다.

자주 묻는 질문 중 하나는 “매번 파워쿼리를 설정하기 귀찮은데 더 간단한 방법은 없나요?”라는 것입니다. 사실 현재 엑셀 버전에서는 파워쿼리가 가장 정석적이고 안전한 방법입니다. 만약 파워쿼리가 어렵게 느껴진다면, 엑셀의 ‘데이터 가져오기’ 마법사를 활용하는 것만으로도 충분합니다. 과정은 파워쿼리와 유사하지만, 인터페이스가 더 직관적이라 초보자도 쉽게 따라 할 수 있습니다.

흔히 발생하는 실수와 해결 방안

파일을 열 때 발생할 수 있는 또 다른 실수는 날짜나 숫자 형식이 텍스트로 인식되어 계산이 되지 않는 경우입니다. 파워쿼리에서는 데이터를 불러올 때 ‘데이터 형식 변경’ 기능을 통해 날짜는 날짜로, 숫자는 숫자로 미리 지정할 수 있습니다. 이렇게 하면 CSV 파일을 열고 나서 다시 서식을 변경해야 하는 번거로움이 사라집니다.

또한, CSV 파일 안에 쉼표(,)가 포함된 데이터가 있을 경우 엑셀이 열을 잘못 나누는 경우가 있습니다. 파워쿼리는 ‘구분 기호’를 사용자가 직접 지정할 수 있게 해주기 때문에, 쉼표 외에도 탭(Tab)이나 세미콜론(;)으로 구분된 파일도 문제없이 처리할 수 있습니다. 이는 엑셀 기본 열기 기능보다 훨씬 강력한 기능입니다.

효율적인 데이터 워크플로우 구축

데이터를 다루는 일은 단순히 파일을 여는 것에서 시작합니다. 한글 깨짐 현상을 해결하는 과정은 단순히 글자를 복구하는 행위를 넘어, 데이터의 구조를 이해하고 시스템 간의 통신 방식을 파악하는 과정입니다. 파워쿼리를 적극적으로 활용하여 데이터 불러오기 과정을 표준화하십시오. 처음에는 다소 생소할 수 있지만, 한 번 익혀두면 수십 분이 걸리던 전처리 시간을 단 몇 초로 단축할 수 있습니다. 인코딩 설정 하나만 제대로 이해해도 데이터 분석의 질이 달라지며, 불필요한 스트레스 없이 생산적인 업무에 집중할 수 있는 환경이 조성될 것입니다.

seagreen33
함께 보면 좋은 글

댓글 0

첫 댓글을 남겨보세요.

error: Content is protected !!

광고 차단 알림

광고 클릭 제한을 초과하여 광고가 차단되었습니다.

단시간에 반복적인 광고 클릭은 시스템에 의해 감지되며, IP가 수집되어 사이트 관리자가 확인 가능합니다.