OCR PDF

استخدم هذه الأداة مباشرة في متصفحك مع معالجة WebAssembly محلية - تبقى ملفاتك على جهازك ما لم تختار صراحةً ميزة AI ترسل النص المستخرج إلى واجهة API الخاصة بنا. تقدّم JoyPDF مستوى مجانيًا للمهام الأساسية على PDF وخطة Premium اختيارية لحدود متقدمة وسير عمل مدعوم بـ AI.

دليل وأسئلة شائعة

OCR PDF

استخرج نصاً قابلاً للبحث من المستندات الممسوحة ضوئياً.

حول هذه الأداة

قم بتحويل ملفات PDF الممسوحة ضوئيًا ومستندات الصور فقط إلى ملفات قابلة للبحث وقابلة للنسخ - تعرف على النص داخل متصفحك باستخدام Tesseract.js، دون تحميل الصفحات إلى مزرعة OCR السحابية. اختر اللغات، وقم بتشغيل التعرف محليًا، وقم بتنزيل PDF بطبقة نص مخفية محاذاة للمسح المرئي. مجاني، بدون حساب. ضروري لعقود الأرشيف والنماذج الحكومية والبحث PDF حيث تحتاج إلى Ctrl+F أو نسخ ولصق أو تمرير PDF-إلى-Word لاحق.

What you get

  • الإخراج: PDF مع طبقة نص غير مرئية فوق كل صفحة - بحث ونسخ العمل في Acrobat وPreview والمتصفحات.
  • المحرك: Tesseract LSTM يعمل محليًا عبر WebAssembly - لا توجد واجهة برمجة تطبيقات OCR تابعة لجهة خارجية بشكل افتراضي.
  • اللغات: حزم متعددة اللغات مدمجة مع + - تعتمد الدقة على بيانات التدريب لكل برنامج نصي.
  • المرئيات: مظهر الصفحة يظل قيد الفحص؛ OCR لا يقوم بإعادة الكتابة أو تنظيف الهوامش المنحرفة تلقائيًا.
  • الكتابة اليدوية: عادةً ما تفشل الكتابة المتصلة والتوقيعات أو تعمل الطباعة المكتوبة جزئيًا بشكل أفضل.
  • الحدود: تستغرق عمليات المسح الكبيرة بدقة 300 نقطة في البوصة وقتًا طويلاً على أجهزة الكمبيوتر المحمولة القديمة؛ النص الباهت جدًا أو الضوضاء الشديدة يقلل من الدقة.

متى تستخدمها

  • جعل الأرشيف الورقي القديم قابلاً للبحث دون إرسال المجلدات إلى بائع OCR خارجي.
  • تحضير العقود الممسوحة ضوئيًا لـ PDF إلى Word عند عدم توفر النص الرقمي الأصلي.
  • تمكين النسخ واللصق من PDFs الحكومية التي تعتبر صورًا من الناحية الفنية.
  • فهرسة حزم الاجتماعات الممسوحة ضوئيًا من المطبوعات لقواعد المعرفة الداخلية.

Why JoyPDF for this

تقوم خدمات Cloud OCR بتحميل كل صفحة - بما في ذلك التوقيعات وأرقام الحسابات والفقرات المصنفة - للتعرف على النص عن بعد. JoyPDF OCR يعمل بالكامل في متصفحك: تبقى وحدات البكسل والسلاسل المعترف بها على الجهاز أثناء المعالجة. يمكنك اختيار اللغات بشكل صريح بدلاً من تخمين الخادم. يناسب ذلك GDPR والامتياز القانوني وسير العمل المجاور حيث يُحظر نقل المستندات الصادرة.

كيفية الاستخدام

  1. 1أضف PDF الممسوحة ضوئيًاقم بإسقاط الملف أو تحديده من جهازك. يتم تحميل الصفحات محليًا - لا توجد قائمة انتظار OCR من جانب الخادم.
  2. 2اختر OCR اللغاتحدد لغات التعرف - على سبيل المثال. الإنجليزية أو البولندية أو eng+pol المدمجة لإجراء عمليات المسح ثنائية اللغة.
  3. 3تشغيل التعرفJoyPDF يعالج كل صفحة على جهازك؛ يظهر التقدم في كل صفحة لأن OCR هو CPU مكثف.
  4. 4تحميل للبحث PDFاحفظ ملف OCR'd - مشابه بصريًا للمسح الضوئي ولكن مع وجود نص قابل للتحديد وقابل للبحث أسفله.
100% في المتصفح
الملفات تبقى على الجهاز
متوافق مع GDPR

About · Blog · Privacy