OCR PDF
Използвайте този инструмент директно в браузъра с локална WebAssembly обработка - файловете ви остават на устройството, освен ако изрично не изберете AI функция, която изпраща извлечения текст към нашето API. JoyPDF предлага безплатно ниво за основни PDF задачи и опционален Premium план с разширени лимити и AI работни процеси.
OCR PDF
Извличайте търсаем текст от сканирани документи.
За този инструмент
Превърнете сканираните PDF и документи само с изображения във файлове с възможност за търсене, удобни за копиране - разпознавайте текст във вашия браузър с Tesseract.js, без да качвате страници в облачна ферма OCR. Изберете езици, стартирайте разпознаване локално и изтеглете PDF със скрит текстов слой, подравнен спрямо видимото сканиране. Безплатно, без акаунт. От съществено значение за архивни договори, държавни формуляри и изследвания PDF, където имате нужда от Ctrl+F, копиране-поставяне или по-късен пропуск PDF-to-Word.
What you get
- Изход: PDF с невидим текстов слой върху всяка страница - търсенето и копирането работят в Acrobat, Preview и браузъри.
- Двигател: Tesseract LSTM работи локално чрез WebAssembly - няма OCR API на трета страна по подразбиране.
- Езици: многоезични пакети, комбинирани с + - точността зависи от данните за обучение за всеки скрипт.
- Визуални изображения: външният вид на страницата остава сканирането; OCR не пренабира или почиства автоматично изкривените полета.
- Почерк: курсивът и подписите обикновено се провалят или частично - печатният печат работи най-добре.
- Ограничения: големи сканирания при 300 dpi отнемат време на по-стари лаптопи; много бледият текст или силният шум намаляват точността.
Кога да го използвате
- Правене на наследен хартиен архив достъпен за търсене без изпращане на томове до външен доставчик на OCR.
- Подготвяне на сканирани договори за PDF to Word, когато не е наличен роден цифров текст.
- Разрешаване на копиране и поставяне от държавни PDF, които технически са изображения.
- Индексиране на пакети от срещи, сканирани от разпечатки за вътрешни бази знания.
Why JoyPDF for this
Облачните услуги OCR качват всяка страница – включително подписи, номера на сметки и класифицирани параграфи – за разпознаване на текст от разстояние. JoyPDF OCR работи изцяло във вашия браузър: пикселите и разпознатите низове остават на устройството по време на обработката. Избирате езици изрично, вместо да гадае сървър. Това отговаря на GDPR, правна привилегия и съседни работни потоци с въздушна междина, където изходящото прехвърляне на документи е забранено.
Как да го използвате
- 1Добавете вашия сканиран PDFПуснете файла или го изберете от вашето устройство. Страниците се зареждат локално - няма опашка OCR от страната на сървъра.
- 2Изберете OCR езициИзберете езици за разпознаване - напр. Английски, полски или комбиниран eng+pol за двуезични сканирания.
- 3Стартирайте разпознаванеJoyPDF обработва всяка страница на вашето устройство; напредъкът се показва на страница, тъй като OCR е CPU-интензивен.
- 4Изтеглете PDF с възможност за търсенеЗапазете файла OCR'd - визуално подобен на сканирания, но с избираем и търсещ текст отдолу.