PDF 텍스트 추출 (PDF → TXT)

PDF를 올리면 문서에 들어 있는 글자를 페이지 순서대로 추출해 보여 줍니다. 결과를 바로 복사하거나 TXT 파일로 저장할 수 있습니다.

📄 PDF 파일을 끌어다 놓거나 눌러서 선택 선택하면 바로 글자를 추출합니다

PDF 텍스트 추출 사용 방법

  1. 글자를 꺼낼 PDF 파일을 선택합니다. 선택하는 즉시 페이지별로 추출이 시작됩니다.
  2. 페이지 사이에 "----- 1쪽 -----" 같은 구분선이 필요 없다면 체크를 해제합니다. 바꾸면 결과에 바로 반영됩니다.
  3. 결과 칸에서 필요한 부분을 직접 선택해 복사하거나 전체 복사를 누릅니다.
  4. TXT로 저장을 누르면 메모장에서 열 수 있는 UTF-8 텍스트 파일로 저장됩니다.

PDF 글자가 복사되지 않는 이유

PDF 뷰어에서 글자를 드래그해 복사하면 줄바꿈이 엉키거나, 두 단 편집 문서에서 좌우 단의 문장이 섞이거나, 글자 사이에 이상한 공백이 생기는 일이 많습니다. PDF는 "어느 위치에 어떤 글자를 그릴지"만 기록하고 문장·문단 구조는 따로 저장하지 않기 때문입니다.

이 도구는 PDF에 기록된 글자 조각의 좌표를 읽어 같은 높이에 있는 조각을 한 줄로 묶고, 줄 간격이 넓은 곳은 문단이 바뀐 것으로 보고 빈 줄을 넣습니다. 그래서 뷰어에서 복사할 때보다 읽기 좋은 텍스트를 얻을 수 있습니다.

스캔한 PDF는 텍스트 추출이 안 되는 경우

스캐너나 스마트폰 카메라로 만든 PDF는 페이지 전체가 하나의 사진입니다. 눈에는 글자로 보여도 파일 안에는 글자 정보가 없으므로 텍스트 추출 결과가 비어 있게 됩니다. 이런 경우 이미지 속 글자를 인식하는 OCR(광학 문자 인식) 프로그램이 필요하며, 이 도구는 OCR을 지원하지 않습니다.

문서가 스캔본인지 확인하려면 PDF 뷰어에서 글자를 드래그해 보세요. 글자 단위로 선택되지 않고 페이지 전체가 선택된다면 이미지로 된 PDF입니다.

추출한 텍스트 활용 팁

  • 보고서나 논문을 인용할 때, 문장을 다시 타이핑하지 않고 바로 붙여 넣을 수 있습니다.
  • 추출한 결과의 줄바꿈이 문장 중간마다 들어가 있다면 줄바꿈 제거 도구로 한 문단으로 정리하세요.
  • 분량 확인이 필요하면 결과를 글자수 세기에 붙여 넣어 글자 수와 바이트를 확인할 수 있습니다.
  • 표는 칸 구분 없이 한 줄의 글자로 추출됩니다. 표 구조가 중요하다면 원본 문서 파일(엑셀, 한글 등)을 구하는 것이 정확합니다.

자주 묻는 질문

PDF 텍스트 추출 결과가 비어 있어요.
스캔하거나 사진으로 만든 PDF는 글자 정보가 없어 추출되지 않습니다. 이 경우 OCR 기능이 있는 프로그램을 사용해야 합니다.
한글이 깨져서 나와요.
일부 PDF는 글꼴 정보를 특수한 방식으로 저장해 글자 코드가 원래 글자와 다르게 기록되어 있습니다. 이런 문서는 어떤 추출 도구로도 정확한 글자를 얻기 어렵습니다.
비밀번호가 걸린 PDF도 되나요?
열기 암호가 있는 PDF는 읽을 수 없습니다. 암호를 해제한 사본을 만든 뒤 사용해 주세요.
추출한 내용이 서버에 남나요?
아니요. PDF 분석과 텍스트 추출은 모두 브라우저 안에서 이루어지며 파일과 결과는 어디에도 전송되지 않습니다.

최종 업데이트: 2026-10-02