PDF OCR — 스캔된 페이지에서 텍스트 추출

스캔 및 이미지 전용 PDF를 검색 가능하고 선택 가능한 텍스트로 바꾸세요. 10개 언어를 인식하고 텍스트를 .txt 파일로 추출하거나 보이지 않는 텍스트 레이어가 있는 검색 가능한 PDF를 만드세요. 모든 것이 브라우저에서 실행됩니다.

주요 기능

10개 이상의 언어

영어, 중국어(간체 및 번체), 일본어, 한국어, 스페인어, 프랑스어, 독일어, 포르투갈어 및 아랍어를 인식하거나 여러 개를 동시에 결합하세요.

검색 가능한 PDF

보이지 않는 텍스트 레이어가 있는 PDF를 만들어 스캔된 페이지가 모든 리더에서 검색 가능하고 선택 가능하게 만드세요.

텍스트 추출

인식된 텍스트를 페이지 구분자와 함께 일반 .txt 파일로 추출하여 편집하거나 복사할 준비를 하세요.

완전한 제어

출력 형식, OCR 품질 및 특정 페이지 범위를 선택하세요 — 전체 문서를 처리할 필요가 없습니다.

100% 비공개

모든 처리가 브라우저에서 로컬로 이루어집니다. 파일이 어떤 서버에도 업로드되지 않습니다.

설치 불필요, 무료

브라우저가 있는 모든 기기에서 작동합니다. 가입 없음, 워터마크 없음, 완전 무료.

PDF OCR이란 무엇인가요?

OCR(광학 문자 인식)은 텍스트 이미지를 기계가 읽을 수 있는 텍스트로 변환합니다. 스캔된 PDF는 사실상 페이지의 그림입니다 — 단어를 검색, 복사 또는 선택할 수 없습니다. 이 도구는 각 페이지를 렌더링하고 신경망 OCR 엔진으로 텍스트를 인식한 다음 인식된 텍스트를 내보내거나 보이지 않는 텍스트 레이어로 PDF에 다시 기록할 수 있게 합니다. 결과는 단어를 검색하고 문장을 선택하고 복사하며 콘텐츠를 자동으로 색인화할 수 있는 문서입니다. 모든 처리가 브라우저에서 로컬로 이루어지므로 문서가 기기를 벗어나지 않습니다.

PDF를 OCR하는 방법

OCR 실행은 몇 단계만 거치면 됩니다. 모든 것이 브라우저에서 이루어집니다.

1

스캔된 PDF 업로드

스캔되거나 이미지 전용 PDF를 끌어다 놓거나 업로드 영역을 클릭하여 선택하세요.

2

옵션 선택

언어, 출력 형식(텍스트 또는 검색 가능한 PDF), 품질 및 선택적 페이지 범위를 선택하세요. 대부분의 문서에서 기본값이 잘 작동합니다.

3

OCR 시작

OCR 시작을 클릭하세요. 각 선택된 페이지가 자동으로 렌더링되고 인식됩니다.

4

결과 다운로드

추출된 .txt 파일 또는 검색 가능한 PDF를 다운로드하세요. 텍스트 출력의 경우 미리보기가 인식된 콘텐츠를 표시합니다.

알아두면 좋은 점

최상의 결과를 위해 명확하고 고해상도의 스캔을 사용하고 올바른 언어를 선택하세요. 매우 작거나 흐릿하거나 심하게 스타일링된 텍스트는 더 낮은 정확도로 인식될 수 있습니다. 비밀번호로 보호된 PDF는 OCR 전에 잠금을 해제해야 합니다. 첫 OCR 실행은 인식 엔진과 언어 데이터를 로드하며 몇 초가 걸릴 수 있습니다. 이후 실행은 더 빠릅니다. 더 높은 품질 설정은 정확도를 향상시키지만 처리를 느리게 합니다. 아랍어 및 일부 문자는 해당 언어만 선택했을 때 가장 잘 인식됩니다.

자주 묻는 질문