기본 콘텐츠로 건너뛰기

Featured post

ChatGPT에 CSV를 올렸는데 한글이 깨질 때 UTF-8로 고치는 법

ChatGPT에 CSV를 올렸는데 한글이 ��� 또는 의미 없는 기호로 보이면 원본 파일은 그대로 보관하고, Excel의 데이터 → 데이터 가져오기 → 텍스트/CSV에서로 파일을 연 뒤 UTF-8로 읽힌 복사본을 만들어 다시 업로드하세요. 깨진 파일에 바로 덮어쓰면 원래 글자를 되살릴 단서까지 잃을 수 있습니다.

텍스트 편집기로 원본 CSV를 열었을 때 한글이 정상이라면 파일 자체보다 여는 프로그램이 인코딩을 다르게 해석했을 가능성이 큽니다. 반대로 텍스트 편집기에서도 이미 깨져 있다면, 깨진 문자를 다시 저장하지 말고 CSV를 만든 원래 프로그램이나 원본 데이터에서 UTF-8로 다시 내보내야 합니다.

정상 복사본을 다시 올린 뒤에는 분석부터 시키지 말고 열 이름, 전체 행·열 수, 첫 5행과 마지막 5행을 먼저 보여 달라고 요청하세요. 한글만 정상으로 보여도 행이 빠지거나 구분자가 달라졌을 수 있으므로 원본 행 수와 고유 키 개수까지 맞아야 해결된 것입니다.

한글이 깨진 CSV 표를 UTF-8로 고쳐 정상 표로 확인하는 모습
깨진 파일을 덮어쓰지 말고 UTF-8 복사본을 만든 뒤 표 구조부터 대조합니다.
가장 짧은 해결 순서
  1. 원본 CSV를 복사해 별도 보관합니다.
  2. 텍스트 편집기에서 한글 표본이 정상인지 확인합니다.
  3. Excel에서 파일을 더블클릭하지 말고 텍스트/CSV 가져오기로 엽니다.
  4. 파일 원본을 UTF-8로 선택하고 한글과 열 구분을 확인합니다.
  5. 새 파일명으로 UTF-8 CSV 복사본을 저장합니다.
  6. ChatGPT에 다시 올려 행·열 수와 표본을 원본과 대조합니다.

먼저 파일이 깨진 것인지, 여는 방법이 잘못된 것인지 나누세요

CSV는 글자 모양을 저장하는 문서가 아니라 쉼표 같은 구분자로 값을 나눈 텍스트 파일입니다. 같은 바이트를 UTF-8, CP949 또는 다른 문자 체계로 읽으면 화면에 나타나는 글자가 달라질 수 있습니다. 그래서 한글 깨짐은 ChatGPT의 번역 문제가 아니라 파일을 읽는 단계의 문제인 경우가 많습니다.

원본 CSV의 복사본을 만든 뒤 메모장 같은 텍스트 편집기로 열어 고객명, 상품명, 지역명처럼 한글이 들어 있는 두세 칸을 찾습니다. 여기서 한글이 정상이라면 원본 데이터는 남아 있을 가능성이 높습니다. Excel에서만 깨졌다면 파일을 더블클릭해 자동으로 열지 말고 가져오기 화면에서 문자 집합을 지정합니다.

텍스트 편집기에서도 ����, 네모 또는 물음표로 보인다면 상황이 다릅니다. 이미 잘못 읽힌 결과를 다시 CSV로 저장했거나 내보내기 단계에서 문자 정보가 손실됐을 수 있습니다. 이때는 깨진 문자열을 ChatGPT에 복원해 달라고 하기보다 원본 Excel 파일, 데이터베이스 내보내기 화면 또는 주문 관리 프로그램으로 돌아가 새 CSV를 만드는 편이 안전합니다.

확인한 화면한글 상태다음 행동
텍스트 편집기정상Excel 가져오기에서 UTF-8로 다시 읽기
텍스트 편집기이미 깨짐원본 프로그램에서 다시 내보내기
Excel 미리보기정상인데 열이 한 칸에 몰림쉼표·세미콜론 구분자 확인
ChatGPT일부 행만 깨짐해당 행의 원본과 저장 경로 확인

Excel에서는 더블클릭 대신 텍스트·CSV 가져오기를 사용하세요

Microsoft의 UTF-8 CSV 열기 안내에 따르면 UTF-8 CSV에 BOM이 있으면 일반적으로 바로 열 수 있지만, 그렇지 않다면 데이터 → 데이터 가져오기 → 파일에서 → 텍스트/CSV에서 경로를 사용할 수 있습니다. 버전에 따라 메뉴 이름은 조금 다를 수 있으나 핵심은 파일을 자동으로 열지 않고 가져오기 미리보기를 거치는 것입니다.

  1. Excel에서 빈 통합 문서를 엽니다.
  2. 데이터 탭에서 텍스트/CSV에서를 선택합니다.
  3. 보관해 둔 원본 CSV를 선택합니다.
  4. 미리보기의 파일 원본을 65001: Unicode (UTF-8)로 맞춥니다.
  5. 한글 열 제목과 첫 행의 이름·주소·상품명이 정상인지 확인합니다.
  6. 쉼표, 세미콜론 또는 탭 중 실제 구분자가 맞는지도 확인합니다.
  7. 정상이라면 데이터를 불러오고 새 이름의 CSV UTF-8 복사본으로 저장합니다.

미리보기에서 UTF-8을 선택했는데 더 심하게 깨진다면 원본이 UTF-8이 아닐 수 있습니다. 가능한 인코딩을 무작정 바꾸며 저장하지 말고, 정상 한글이 나타나는 설정을 찾은 뒤 그 상태에서 UTF-8 복사본을 만듭니다. 업무 시스템에서 다시 내려받을 수 있다면 내보내기 옵션에 UTF-8 또는 CSV UTF-8이 있는지 먼저 확인하세요.

확장자를 .csv에서 .xlsx로 이름만 바꾸는 것은 변환이 아닙니다. Excel에서 정상적으로 읽은 데이터를 새 통합 문서나 CSV UTF-8 형식으로 저장해야 합니다. 여러 시트·수식·서식이 필요하다면 CSV로 다시 만들기보다 XLSX 복사본을 사용하는 편이 맞습니다.

다시 올린 뒤에는 분석보다 표 구조를 먼저 확인하세요

OpenAI Docs의 표 데이터 정리 안내는 CSV나 스프레드시트를 다룰 때 원본을 바꾸지 않고 정리된 복사본을 만들며, 변경하거나 확신하지 못한 행을 기록하도록 안내합니다. 한글이 정상으로 보이는 것만 확인하고 곧바로 매출·재고 합계를 믿어서는 안 됩니다.

다시 업로드한 뒤 요청할 문장

이 CSV를 아직 계산하지 말고 구조만 점검해 주세요. 파일명, 인식한 인코딩, 열 이름, 전체 행·열 수, 첫 5행과 마지막 5행을 보여 주세요. 빈 열과 중복 가능성이 있는 고유 키 개수도 알려 주세요. 원본 파일은 수정하지 말고 이상이 있으면 분석을 멈춰 주세요.

원본 Excel 또는 업무 시스템에서 확인한 행 수와 ChatGPT가 읽은 행 수를 비교합니다. 주문번호나 고객 ID처럼 행을 구분하는 열이 있다면 전체 행 수뿐 아니라 고유값 개수도 확인합니다. 첫 행만 정상이더라도 파일 중간에 다른 인코딩으로 붙여 넣은 데이터가 섞였을 수 있으므로 첫·마지막 표본과 한글이 많은 열을 함께 봅니다.

합계가 원본과 다르다면 인코딩을 반복해서 바꾸기보다 ChatGPT가 읽은 Excel 합계와 원본이 다를 때 확인하는 순서로 필터, 숨김 행, 텍스트 숫자와 중복 행을 점검하세요. 한글이 정상화된 것과 계산 결과가 맞는 것은 별개의 확인 단계입니다.

UTF-8로 바꿔도 해결되지 않는 경우

원본에서 물음표로 저장된 경우

문자가 이미 ?로 대체돼 저장됐다면 인코딩 이름만 바꿔 원래 한글을 되살릴 수 없습니다. 원본 데이터베이스, XLSX, 주문 내역 또는 이전 백업에서 다시 내보내야 합니다. 일부 열만 손상됐다면 정상 원본과 고유 키를 기준으로 해당 열만 다시 결합하고 변경 행을 따로 검토합니다.

한 파일 안에 서로 다른 인코딩이 섞인 경우

여러 시스템에서 복사한 값을 한 CSV에 합치면서 일부 행만 깨질 수 있습니다. 정상 행이 많다는 이유로 전체를 덮어쓰지 말고, 깨진 행 번호와 고유 키를 분리한 뒤 출처별로 다시 내보냅니다. 매출·재고·재무 자료라면 자동 복원 결과를 확정값으로 사용하지 말고 원본 시스템의 건수와 합계를 대조해야 합니다.

한글은 정상인데 모든 열이 한 칸에 들어간 경우

이것은 문자 인코딩보다 구분자 문제일 가능성이 큽니다. 쉼표 CSV를 세미콜론 CSV로 읽거나 반대로 읽으면 한 행 전체가 한 셀에 들어갈 수 있습니다. 해당 문제는 인코딩을 더 바꾸지 말고 가져오기 미리보기에서 구분자를 맞춰 해결합니다.

쉼표와 줄바꿈 때문에 열이 밀린 경우

상품 설명이나 메모 안에 쉼표·줄바꿈·따옴표가 있으면 필드 경계가 달라질 수 있습니다. 한글 깨짐처럼 보여도 실제로는 열이 밀린 것일 수 있으므로 열 제목 개수와 각 행의 필드 개수가 같은지 확인합니다. 필요한 표 구조를 지정하려면 ChatGPT 답변을 표로 정리하게 만드는 방법을 이어서 적용할 수 있습니다.

업로드 전 마지막 확인표

  • 원본 CSV를 덮어쓰지 않고 별도 보관했는가
  • 한글 열 제목과 값 표본이 텍스트 편집기 또는 가져오기 미리보기에서 정상인가
  • UTF-8 복사본을 새 파일명으로 저장했는가
  • 쉼표·세미콜론·탭 구분자가 실제 파일과 맞는가
  • 전체 행·열 수와 고유 키 개수가 원본과 같은가
  • 첫 5행과 마지막 5행의 값이 원본과 일치하는가
  • 매출·재고·재무 합계를 원본 시스템과 다시 대조했는가

AIZip(www.aizip.ai.kr)은 한글이 보이기 시작한 시점이 아니라 원본 행 수·고유 키·표본까지 일치한 시점을 복구 완료 기준으로 봅니다. 상품 CSV 자체가 Shopify에서 값을 덮어쓴 문제라면 인코딩 문제와 분리해 Shopify CSV 뒤 상품 설명이 바뀐 원인을 확인하세요.

자주 묻는 질문

UTF-8 CSV인데도 ChatGPT에서 한글이 깨질 수 있나요?

가능합니다. 파일이 UTF-8로 표시돼도 이전 단계에서 이미 문자가 깨졌거나 일부 행이 다른 인코딩에서 붙여 넣어진 경우가 있습니다. 텍스트 편집기와 Excel 가져오기 미리보기에서 원본 한글 표본을 먼저 확인하세요.

CSV 파일 확장자를 XLSX로 바꾸면 해결되나요?

아니요. 파일 이름의 확장자만 바꾸면 내부 문자 인코딩과 구조는 바뀌지 않습니다. Excel에서 원본 인코딩으로 정상적으로 불러온 뒤 새 XLSX 또는 CSV UTF-8 파일로 저장해야 합니다.

깨진 CSV를 Excel에서 UTF-8로 다시 저장하면 원래 한글이 돌아오나요?

Excel에서 올바른 인코딩으로 읽어 한글이 정상으로 보이는 상태라면 새 UTF-8 복사본을 만들 수 있습니다. 이미 물음표나 대체문자로 저장된 파일은 다시 저장해도 복원되지 않으므로 원본 데이터에서 다시 내보내야 합니다.

CSV 대신 XLSX를 ChatGPT에 올리는 편이 낫나요?

여러 시트, 수식, 셀 서식과 원본 구조를 확인해야 한다면 XLSX 복사본이 더 적합할 수 있습니다. 한 시트의 평면 표만 분석한다면 열과 행을 검증한 UTF-8 CSV도 사용할 수 있습니다.

ChatGPT가 깨진 한글을 자동으로 복원해 줄 수 있나요?

일부 문자열을 추측할 수는 있지만 정확한 복원을 보장할 수 없습니다. 고객명, 주소, 상품명과 숫자 자료는 추측 결과를 사용하지 말고 정상 원본에서 다시 내보낸 파일과 대조해야 합니다.

댓글

Most Popular

ChatGPT 시작 기준과 사용 절차, 초보자가 먼저 알아야 할 차이

ChatGPT 무료·유료 차이 비교와 선택 기준, 초보자 첫 사용법

챗GPT 프로젝트 기능 사용법: 작업 공간 구조화와 공유