OCR (문자 인식)

스캔한 PDF를 한국어·영어로 인식해 글자 선택·검색이 되는 PDF와 텍스트 파일로 만듭니다.

이 도구는 파일을 서버에 올리지 않습니다. 브라우저를 닫으면 아무것도 남지 않습니다.

여기에 파일을 끌어다 놓거나

파일 선택

지원 형식: PDF · Ctrl+V로 붙여넣기 가능

스캔한 PDF에서 글자 인식하기

종이를 스캔하거나 사진으로 찍어 만든 PDF는 겉보기에는 글자처럼 보여도 실제로는 그림입니다. 복사도 검색도 되지 않습니다. OCR은 그 그림 속 글자를 읽어 내어 텍스트로 만들어 줍니다.

인식 언어는 한국어+영어, 영어, 한국어, 일본어+영어, 중국어 간체+영어 중에서 고릅니다. 결과는 텍스트로 받거나, 원본 위에 보이지 않는 텍스트 층을 덧입힌 검색 가능한 PDF로 받을 수 있습니다. 후자는 겉모습은 그대로인데 Ctrl+F 검색이 되는 파일입니다.

인식률은 원본 상태에 좌우됩니다. 반듯하게 스캔된 300dpi 이상의 문서는 정확도가 높고, 비뚤어지거나 흐린 사진은 오타가 늘어납니다. 처리는 브라우저 안에서 이루어지므로 민감한 서류도 밖으로 나가지 않습니다.

사용 방법

  1. 1

    스캔 PDF를 선택합니다.

  2. 2

    언어를 확인하고 시작하기를 누릅니다.

  3. 3

    검색 가능한 PDF와 .txt를 내려받습니다.

자주 묻는 질문

얼마나 걸리나요?
페이지당 3~10초 정도입니다. 첫 실행 시 언어 데이터(약 4MB)를 받습니다.
정확도는요?
깨끗한 인쇄물은 높고, 흐린 스캔·손글씨는 낮습니다. 표 구조는 인식하지 않습니다.
어떤 언어를 인식하나요?
한국어+영어, 영어, 한국어, 일본어+영어, 중국어 간체+영어 중에서 고를 수 있습니다. 목록에 없는 언어는 인식되지 않습니다.
인식률을 높이려면요?
300dpi 이상으로 반듯하게 스캔하고 그림자가 지지 않게 하면 정확도가 올라갑니다.
결과를 어떤 형식으로 받나요?
텍스트로 받거나, 원본 위에 텍스트 층을 입힌 검색 가능한 PDF로 받을 수 있습니다.
문서가 서버로 가나요?
아니요. 인식도 브라우저 안에서 이루어집니다.

관련 도구