텍스트 인코딩 변환 사용 방법
- 한글이 깨지는 파일을 위 영역에 끌어다 놓습니다. 여러 파일을 한 번에 넣을 수 있습니다.
- 도구가 파일마다 원본 인코딩(UTF-8, EUC-KR 등)을 자동으로 찾아 표시하고, 파일 이름을 누르면 아래에서 내용을 미리 볼 수 있습니다.
- 미리 보기에서 한글이 여전히 깨져 있다면 원본 인코딩을 직접 골라 봅니다.
- 필요하면 줄바꿈 방식과 BOM 여부를 정하고, 파일별 저장 또는 모두 저장(ZIP)을 누릅니다. 파일 이름은 원본과 같게 저장됩니다.
자막이나 txt 파일의 한글이 깨지는 이유
컴퓨터는 글자를 숫자(바이트)로 저장하는데, 그 규칙을 인코딩이라고 합니다. 한국에서는 오랫동안 EUC-KR(윈도우에서는 CP949, "ANSI")을 썼고, 지금은 전 세계 표준인 UTF-8을 씁니다. 같은 "한"이라는 글자도 EUC-KR에서는 C7 D1, UTF-8에서는 ED 95 9C로 저장됩니다.
EUC-KR로 저장된 자막을 UTF-8만 읽는 동영상 플레이어·스마트 TV·웹 서비스에 넣으면 바이트를 엉뚱하게 해석해 한글이 깨집니다. 반대로 UTF-8 파일을 오래된 프로그램에서 열면 "?"나 이상한 한자로 보이기도 합니다. 이 도구는 원래 인코딩으로 정확히 읽은 뒤 UTF-8로 다시 저장해 문제를 해결합니다.
EUC-KR UTF-8 자동 감지 방식
- 파일 맨 앞에 BOM(인코딩 표시 바이트)이 있으면 그대로 따릅니다.
EF BB BF는 UTF-8,FF FE는 UTF-16 LE입니다. - BOM이 없으면 UTF-8 규칙으로 엄격하게 읽어 봅니다. 규칙에 어긋나는 바이트가 하나도 없으면 UTF-8로 판단합니다.
- UTF-8로 읽을 수 없으면 한국어 파일에서 가장 흔한 EUC-KR(CP949)로 읽습니다.
일본어·중국어 자막처럼 다른 언어 파일은 자동 감지가 틀릴 수 있습니다. 미리 보기에 깨진 글자(�)가 보이면 원본 인코딩을 Shift_JIS, GB18030, Big5 등으로 직접 바꿔 보세요. 깨진 글자 수가 0이 되는 인코딩이 정답일 가능성이 높습니다.
BOM과 줄바꿈(CRLF·LF)은 어떻게 고르나요?
| 상황 | BOM | 줄바꿈 |
|---|---|---|
| 윈도우 메모장, 엑셀에서 열 CSV | 붙이기 | CRLF |
| 스마트 TV·플레이어용 자막(smi, srt) | 붙이기(대부분 호환) | 원본 유지 |
| 웹 페이지, 프로그램 소스, 리눅스 서버 설정 파일 | 빼기 | LF |
BOM은 "이 파일은 UTF-8"이라는 표시로, 윈도우 프로그램이 인코딩을 헷갈리지 않게 도와줍니다. 다만 일부 프로그래밍 도구는 BOM을 글자로 인식해 오류를 내므로 개발용 파일은 BOM 없이 저장하는 것이 안전합니다.
UTF-8로만 저장하는 이유
브라우저의 표준 기능(TextEncoder)은 보안과 호환성 때문에 UTF-8로만 저장할 수 있습니다. UTF-8은 한글·영어·이모지를 포함한 모든 문자를 표현할 수 있고, 최신 윈도우 메모장·한글 프로그램·스마트폰·스마트 TV가 모두 읽을 수 있어 실제로는 UTF-8로 바꾸는 쪽이 문제를 해결하는 방향입니다. 꼭 EUC-KR 파일이 필요하다면 윈도우 메모장에서 파일을 열고 "다른 이름으로 저장 > 인코딩: ANSI"를 선택하세요.