تحويل الصورة إلى PDF قابل للبحث باستخدام بايثون

هذا الدليل يصف كيفية تحويل image إلى PDF القابلة للبحث باستخدام بايثون. يحتوي على تفاصيل لتعيين بيئة التطوير المتكاملة، قائمة بالخطوات، وعينة كود لتغيير صورة إلى PDF قابل للقراءة باستخدام بايثون. يمكن تحسين عينة الكود أكثر لإنشاء ملف PDF مخصص عن طريق اتباع الاقتراحات المقدمة.

خطوات تحويل الصورة إلى PDF قابل للبحث باستخدام بايثون

  1. قم بتعيين البيئة لاستخدام Aspose.OCR for Python via .NET لتغيير JPG الممسوح ضوئياً إلى PDF
  2. استورد مكتبة OCR للتعرف على النص من ملف JPG وحفظ النص إلى PDF
  3. تعيين المجلد للصور المدخلة وملفات PDF الناتجة
  4. إنشاء OCR engine للتعرف على النص من صورة ممسوحة ضوئياً
  5. تحميل الصورة الممسوحة ضوئياً للمعالجة باستخدام الفئة OcrInput
  6. تشغيل عملية التعرف لاستخراج النص
  7. طباعة النص لمعلومات المستخدم
  8. احفظ كل مقطع نصي في ملف PDF منفصل

الخطوات المذكورة أعلاه تشمل العملية لتحويل صورة إلى PDF قابل للبحث باستخدام Python. استورد مكتبة Aspose المطلوبة، طبق الترخيص، حدد المجلدات المطلوبة، أنشئ محرك OCR، وأنشئ كائن OcrInput لاحتواء الصور المطلوبة للمعالجة. شغّل طريقة recognize () لجلب النص، وتكرّر عبر قائمة النتائج، اعرض كل نتيجة، واحفظ كل واحدة في ملف PDF منفصل.

كود لتحويل الصورة إلى PDF قابل للقراءة باستخدام بايثون

يعرض الكود النموذجي أعلاه كيفية تحويل JPG إلى PDF قابل للقراءة باستخدام Python. لتحسين عملية التحويل، يمكنك تجربة RecognitionSettings لتغيير السلوك مثل ضبط لغة التعرف، تمكين عكس الألوان تلقائيًا، أو تمكين تكبير الخط الصغير. يمكنك أيضًا تعيين قائمة أحرف مسموح بها أو مستبعدة، واستخدام recognize_fast() بدلاً من recognize() للصور عالية الجودة، والتحقق من result.skew للتعامل مع مسح مائل.

هذا الدليل يشرح العملية لتطبيق OCR على صورة وحفظ النتيجة في ملف PDF. لإزالة الضوضاء من صورة، راجع المقال إزالة الضوضاء من الصورة باستخدام بايثون.

 عربي