PDF → 텍스트
PDF의 텍스트 레이어를 추출해 .txt로 저장합니다. 스캔본(이미지) PDF는 추출되지 않습니다.
이 도구는 파일을 서버에 올리지 않습니다. 브라우저를 닫으면 아무것도 남지 않습니다.
여기에 파일을 끌어다 놓거나
파일 선택지원 형식: PDF · Ctrl+V로 붙여넣기 가능
PDF에서 텍스트만 추출하기
논문이나 보고서의 내용을 인용하거나, 여러 문서의 본문을 한꺼번에 검색하고 싶을 때는 서식 없는 텍스트가 가장 다루기 좋습니다. 이 도구는 PDF에 들어 있는 글자를 그대로 뽑아 .txt로 저장합니다.
결과는 UTF-8로 저장되므로 한글이 깨지지 않습니다. 메모장에서 이상하게 보인다면 인코딩을 UTF-8로 지정해 열어 주세요.
스캔본처럼 글자가 이미지로 들어 있는 PDF에서는 아무 텍스트도 나오지 않습니다. 이 경우 PDF OCR을 먼저 돌려 글자를 인식시켜야 합니다.
사용 방법
- 1
PDF를 선택합니다.
- 2
필요하면 페이지 범위를 지정합니다.
- 3
시작하기를 누르고 결과를 내려받습니다.
자주 묻는 질문
- 결과가 비어 있어요.
- 스캔한 이미지 PDF에는 텍스트 레이어가 없습니다. 이런 문서는 AI 변환 도구를 이용해 주세요.
- 줄바꿈이 이상해요.
- PDF는 줄 정보를 저장하지 않아 위치를 기준으로 추정합니다. 다단 문서는 순서가 섞일 수 있습니다.
- 한글이 깨져요.
- 결과는 UTF-8입니다. 메모장에서 인코딩을 UTF-8로 지정해 열어 주세요.
- 줄바꿈이 이상하게 들어갑니다.
- PDF는 줄 단위로 글자를 저장해 원본의 줄바꿈이 그대로 따라옵니다.
- 스캔본에서 텍스트가 안 나와요.
- 글자가 사진이기 때문입니다. PDF OCR을 이용하세요.