OCR PDF
Χρησιμοποιήστε αυτό το εργαλείο απευθείας στον browser με τοπική επεξεργασία WebAssembly - τα αρχεία σας παραμένουν στη συσκευή, εκτός αν επιλέξετε ρητά λειτουργία AI που στέλνει εξαγόμενο κείμενο στο API μας. Το JoyPDF προσφέρει δωρεάν επίπεδο για βασικές PDF εργασίες και προαιρετικό Premium πλάνο για προηγμένα όρια και AI ροές εργασίας.
OCR PDF
Εξάγετε αναζητήσιμο κείμενο από σαρωμένα έγγραφα.
Σχετικά με αυτό το εργαλείο
Μετατρέψτε τα σαρωμένα PDF και έγγραφα μόνο με εικόνα σε αρχεία με δυνατότητα αναζήτησης, φιλικά προς την αντιγραφή - αναγνωρίστε το κείμενο μέσα στο πρόγραμμα περιήγησης με το Tesseract.js, χωρίς να ανεβάσετε σελίδες σε ένα φάρμα σύννεφο OCR. Επιλέξτε γλώσσες, εκτελέστε την αναγνώριση τοπικά και πραγματοποιήστε λήψη ενός PDF με ένα κρυφό επίπεδο κειμένου ευθυγραμμισμένο με την ορατή σάρωση. Δωρεάν, χωρίς λογαριασμό. Απαραίτητο για αρχειακές συμβάσεις, κρατικά έντυπα και ερευνητικά PDF όπου χρειάζεστε Ctrl+F, copy-paste ή μεταγενέστερο πάσο PDF-to-Word.
What you get
- Έξοδος: PDF με ένα αόρατο επίπεδο κειμένου σε κάθε σελίδα - εργασία αναζήτησης και αντιγραφής σε Acrobat, Προεπισκόπηση και προγράμματα περιήγησης.
- Κινητήρας: Tesseract LSTM που λειτουργεί τοπικά μέσω WebAssembly - χωρίς OCR API τρίτου κατασκευαστή από προεπιλογή.
- Γλώσσες: πακέτα πολλών γλωσσών σε συνδυασμό με την ακρίβεια + - εξαρτάται από τα δεδομένα εκπαίδευσης για κάθε σενάριο.
- Οπτικά: η εμφάνιση της σελίδας παραμένει στη σάρωση. Το OCR δεν επαναρυθμίζει ούτε καθαρίζει αυτόματα τα λοξά περιθώρια.
- Χειρόγραφο: η γραφή και οι υπογραφές συνήθως αποτυγχάνουν ή μερικώς - η τυπωμένη γραφή λειτουργεί καλύτερα.
- Όρια: οι μεγάλες σαρώσεις στα 300 dpi χρειάζονται χρόνο σε παλαιότερους φορητούς υπολογιστές. Το πολύ αχνό κείμενο ή ο έντονος θόρυβος μειώνει την ακρίβεια.
Πότε να το χρησιμοποιήσετε
- Δημιουργία αρχείου παλαιού τύπου με δυνατότητα αναζήτησης χωρίς αποστολή τόμων σε εξωτερικό προμηθευτή OCR.
- Προετοιμασία σαρωμένων συμβολαίων για το PDF to Word όταν δεν υπάρχει διαθέσιμο ψηφιακό κείμενο.
- Ενεργοποίηση αντιγραφής-επικόλλησης από κυβερνητικές PDF που είναι τεχνικά εικόνες.
- Ευρετηρίαση πακέτων συσκέψεων που έχουν σαρωθεί από εκτυπώσεις για εσωτερικές βάσεις γνώσεων.
Why JoyPDF for this
Οι υπηρεσίες Cloud OCR ανεβάζουν κάθε σελίδα - συμπεριλαμβανομένων των υπογραφών, των αριθμών λογαριασμών και των ταξινομημένων παραγράφων - για να μην αναγνωρίσουν το κείμενο από το κείμενο. Το JoyPDF OCR εκτελείται από ολοκλήρου στο πρόγραμμα περιήγησής σας: τα pixel και οι αναγνωρισμένες συμβολοσειρές παραμένουν στη συσκευή κατά την επεξεργασία. Επιλέγετε ρητά γλώσσες αντί να μαντεύει ο διακομιστής. Αυτό ταιριάζει με GDPR, νομικά προνόμια και γειτονικές ροές εργασίας με διάκενο αέρα όπου απαγορεύεται η μεταφορά εξερχόμενων εγγράφων.
Πώς να το χρησιμοποιήσετε
- 1Προσθέστε το σαρωμένο PDFΡίξτε το αρχείο ή επιλέξτε το από τη συσκευή σας. Οι σελίδες φορτώνονται τοπικά - δεν υπάρχει ουρά OCR από την πλευρά του διακομιστή.
- 2Επιλέξτε γλώσσες OCRΕπιλέξτε γλώσσες αναγνώρισης - π.χ. Αγγλικά, πολωνικά ή συνδυαστικά eng+pol για δίγλωσσες σαρώσεις.
- 3Αναγνώριση εκτέλεσηςΤο JoyPDF επεξεργάζεται κάθε σελίδα στη συσκευή σας. Η πρόοδος εμφανίζεται ανά σελίδα επειδή το OCR είναι έντασης CPU.
- 4Λήψη PDF με δυνατότητα αναζήτησηςΑποθηκεύστε το αρχείο OCR'd - οπτικά παρόμοιο με τη σάρωση αλλά με επιλέξιμο κείμενο με δυνατότητα αναζήτησης από κάτω.