OCR لملفات PDF: إنشاء PDF قابل للبحث
تحويل مستند منزلي ممسوح ضوئيًا إلى PDF بنص قابل للتحديد للبحث والنسخ لاحقًا؛ العربية والإنجليزية والإسبانية والروسية، حتى 10 صفحات. تبقى الملفات داخل المتصفح.
ملفات التعرف ≈ 26 MB عند أول استخدام، بالإضافة إلى بيانات اللغة.
النص المتعرف عليه
هل كانت هذه الأداة مفيدة؟
تجربة مثال
تنزيل ملف نموذجيإبقاء اللغة المحددة «العربية». تنزيل ملف PDF والبحث عن «فاتورة» و148.50 و«سارة أحمد» و2048. ينبغي أن تبدو الصفحتان مثل النموذج، مع نص يمكن تحديده ونسخه.
النتيجة المتوقعة
يتم التعرف على كل صفحة كصورة، بالترتيب. تتوفر اللغة الإنجليزية والروسية والتعرف المختلط. قد يخطئ OCR في قراءة الحروف والأرقام والأعمدة والجداول؛ لذا ينبغي مراجعة النتيجة. ينتج عن ذلك PDF جديد من صور الصفحات المعروضة وطبقة نصية غير مرئية. يبقى حجم الصفحة المرئي وتدويرها كما هما؛ ولا يتم الاحتفاظ بالنماذج والروابط والإشارات المرجعية والمرفقات والتواقيع الرقمية. يُعاد التعرف على النص الموجود؛ وتتحدد جودة الصورة بدقة العرض.
يتم عرض كل صفحة بدقة تصل إلى 4 ميغابكسل. يستغرق التحميل وكل خطوة معالجة حتى 90 ثانية؛ وتتوقف المهمة بالكامل بعد 10 دقائق. تُعلَّم الصفحات الفارغة في النص. لا يُعرض التنزيل إذا فشلت المعالجة أو لم يتم التعرف على أي نص.
هل الملف محمي بكلمة مرور؟يلزم إلغاء قفله أولًا بكلمة المرور الخاصة به.
قد يؤدي التشغيل الأول إلى تنزيل ملفات المحول ويستغرق بعض الوقت. إذا فشلت العملية، يمكن التحقق من الاتصال أو تجربة ملف أصغر. يوقف زر «إلغاء» المعالجة الجارية؛ ويمكن اختيار ملف آخر وإعادة المحاولة.
تراخيص المحركات والشيفرة المصدرية
دليل عملي
جعل المسح الضوئي قابلًا للبحث أخيرًا.
- اختيار PDF ممسوح ضوئيًا حتى 10 صفحات و10 MiB.
- اختيار العربية أو الإنجليزية أو الإسبانية أو الروسية وتشغيل التعرف.
- البحث عن كلمة معروفة في النتيجة للتأكد من عمل الطبقة النصية.
تجربة هذا المثال
التعرف على نموذج مدرسي ممسوح من 3 صفحات بالإنجليزية؛ ينبغي أن يظهر البحث عن اسم مطبوع في الصفحة 2 تظليلًا له في PDF الناتج.
قبل البدء: يدعم التعرف العربية والإنجليزية والإسبانية والروسية فقط، ويقتصر على 10 صفحات و10 MiB؛ وقد يفوته الخط اليدوي أو الطباعة الصغيرة جدًا.