OCR PDF

이 도구는 로컬 WebAssembly 처리로 브라우저에서 바로 사용할 수 있습니다. 추출된 텍스트를 API로 보내는 AI 기능을 명시적으로 선택하지 않는 한 파일은 기기에 남습니다. JoyPDF는 핵심 PDF 작업용 무료 요금제와 고급 한도 및 AI 워크플로를 위한 선택형 Premium 플랜을 제공합니다.

가이드 및 FAQ

OCR PDF

스캔 문서에서 검색 가능한 텍스트를 추출합니다.

이 도구 소개

스캔한 PDF 및 이미지 전용 문서를 검색 및 복사 가능한 파일로 변환하세요. 클라우드 OCR 팜에 페이지를 업로드하지 않고도 Tesseract를 사용하여 브라우저에서 텍스트를 인식할 수 있습니다. 언어를 선택하고, 기본적으로 인식을 실행하고, 보이는 스캔과 정렬된 숨겨진 텍스트 레이어가 있는 PDF를 다운로드하세요. 무료이며 계정이 필요하지 않습니다. Ctrl+F는 복사하여 붙여넣거나 다음 PDF에서 Word로 전환해야 하는 보관 계약서, 공식 양식, 연구 PDF에 꼭 필요합니다.

What you get

  • 출력: 모든 페이지에 보이지 않는 텍스트 레이어가 있는 PDF - 검색 및 복사는 Acrobat, Preview 및 브라우저에서 작동합니다.
  • 엔진: WebAssembly(기본 Tesseract LSTM 포함) - 기본적으로 타사 OCR API가 없습니다.
  • 언어: +와 결합된 여러 언어 팩 - 정확도는 각 텍스트의 훈련 데이터에 따라 달라집니다.
  • 이미지: 페이지 보기 탐색이 유지됩니다. OCR은 기울어진 가장자리나 여백을 자동으로 수정하지 않습니다.
  • 필기: 필기 ​​및 서명이 실패하거나 부분적인 경우가 많습니다. 타자기 인쇄가 가장 잘 작동합니다.
  • 제한 사항: 구형 노트북에서는 대형 300dpi 스캔에 시간이 걸립니다. 텍스트가 너무 희미하거나 노이즈가 있으면 정확성이 떨어집니다.

사용 시점

  • 외부 OCR 공급업체에 볼륨을 보내지 않고도 오래된 종이 아카이브를 검색 가능하게 만듭니다.
  • 기본 디지털 텍스트를 사용할 수 없는 경우 PDF에서 Word로 스캔된 계약서를 준비합니다.
  • 기술적으로 이미지인 PDF에서 이미지 복사를 활성화합니다.
  • 내부 지식 기반에 대한 인쇄된 스캔에서 회의 패키지를 색인화합니다.

Why JoyPDF for this

Cloud OCR 서비스는 각 페이지를 로드하여 서명, 계좌 번호, 숨겨진 단락을 포함하여 원격으로 인식합니다. JoyPDF OCR은 브라우저에서 완전히 실행됩니다. 프로세스 중에 픽셀과 인식된 문자열이 장치에 남아 있습니다. 서버가 추측하도록 하는 대신 명시적으로 언어를 선택합니다. GDPR는 변호사 특권과 아웃바운드 문서 전송이 금지된 에어 갭 워크플로를 준수합니다.

사용 방법

  1. 1스캔한 PDF를 첨부하세요파일을 삭제하거나 장치에서 선택하세요. 페이지가 로컬로 로드됩니다. 서버측 OCR 대기열이 없습니다.
  2. 2OCR 언어 선택인식 언어 선택 - 예: 터키어, 영어 또는 이중 언어 스캔의 경우 tur+eng.
  3. 3인식 실행JoyPDF는 기기의 각 페이지를 렌더링합니다. OCR은 CPU를 많이 사용하므로 페이지별로 진행됩니다.
  4. 4검색 가능한 PDF 다운로드OCR된 파일을 저장합니다. 시각적으로 스캔과 유사하지만 아래에 선택 및 검색 가능한 텍스트가 있습니다.
100% 브라우저 내
파일은 기기에 유지
GDPR 준수

About · Blog · Privacy