OCR (문자 인식)
스캔한 PDF를 한국어·영어로 인식해 글자 선택·검색이 되는 PDF와 텍스트 파일로 만듭니다.
이 도구는 파일을 서버에 올리지 않습니다. 브라우저를 닫으면 아무것도 남지 않습니다.
여기에 파일을 끌어다 놓거나
파일 선택지원 형식: PDF · Ctrl+V로 붙여넣기 가능
스캔한 PDF에서 글자 인식하기
종이를 스캔하거나 사진으로 찍어 만든 PDF는 겉보기에는 글자처럼 보여도 실제로는 그림입니다. 복사도 검색도 되지 않습니다. OCR은 그 그림 속 글자를 읽어 내어 텍스트로 만들어 줍니다.
인식 언어는 한국어+영어, 영어, 한국어, 일본어+영어, 중국어 간체+영어 중에서 고릅니다. 결과는 텍스트로 받거나, 원본 위에 보이지 않는 텍스트 층을 덧입힌 검색 가능한 PDF로 받을 수 있습니다. 후자는 겉모습은 그대로인데 Ctrl+F 검색이 되는 파일입니다.
인식률은 원본 상태에 좌우됩니다. 반듯하게 스캔된 300dpi 이상의 문서는 정확도가 높고, 비뚤어지거나 흐린 사진은 오타가 늘어납니다. 처리는 브라우저 안에서 이루어지므로 민감한 서류도 밖으로 나가지 않습니다.
사용 방법
- 1
스캔 PDF를 선택합니다.
- 2
언어를 확인하고 시작하기를 누릅니다.
- 3
검색 가능한 PDF와 .txt를 내려받습니다.
자주 묻는 질문
- 얼마나 걸리나요?
- 페이지당 3~10초 정도입니다. 첫 실행 시 언어 데이터(약 4MB)를 받습니다.
- 정확도는요?
- 깨끗한 인쇄물은 높고, 흐린 스캔·손글씨는 낮습니다. 표 구조는 인식하지 않습니다.
- 어떤 언어를 인식하나요?
- 한국어+영어, 영어, 한국어, 일본어+영어, 중국어 간체+영어 중에서 고를 수 있습니다. 목록에 없는 언어는 인식되지 않습니다.
- 인식률을 높이려면요?
- 300dpi 이상으로 반듯하게 스캔하고 그림자가 지지 않게 하면 정확도가 올라갑니다.
- 결과를 어떤 형식으로 받나요?
- 텍스트로 받거나, 원본 위에 텍스트 층을 입힌 검색 가능한 PDF로 받을 수 있습니다.
- 문서가 서버로 가나요?
- 아니요. 인식도 브라우저 안에서 이루어집니다.