مكتبة Ruby مجانية لتحويل الصورة إلى نص وملفات PDF قابلة للبحث
مكتبة Ruby OCR مفتوحة المصدر تمكّن مطوري البرمجيات من تنفيذ التعرف الضوئي على الأحرف لاستخراج النص من المستندات الممسوحة ضوئياً، الصور، أو حتى لقطات الشاشة
ما هو RTesseract؟
التعرف الضوئي على الأحرف (OCR) يعمل كجسر تحولي بين الوسائط البصرية والبيانات الرقمية، مما يمكّن الآلات من استخراج النص من الصور والوثائق الممسوحة بدقة. بالنسبة للمطورين داخل بيئة Ruby، توفر مكتبة RTesseract المفتوحة المصدر بوابة عالية الكفاءة لقوة محرك Tesseract OCR. تم تطويره أصلاً بواسطة شركة Hewlett-Packard وتم تحسينه لاحقًا من قبل Google، ويُعَتَبر Tesseract حلاً رائدًا لتحويل الصورة إلى نص. من خلال عمله كواجهة متقدمة، يتيح RTesseract دمج Tesseract OCR بسلاسة في أي مشروع Ruby، مما يلغي الحاجة إلى إدارة تفاعلات سطر الأوامر المعقدة يدويًا مع الحفاظ على الدقة المطلوبة لرقمنة المستندات على مستوى احترافي.
بعيدًا عن سهولة الاستخدام، RTesseract هي مكتبة روبي متعددة الاستخدامات صُممت لدعم مجموعة واسعة من صيغ الصور، بما في ذلك PNG و JPEG و BMP و TIFF. تضمن هذه المرونة التوافق مع أي مصدر بصري تقريبًا، بينما تمكنها القدرة على الاستفادة من ملفات البيانات العالمية لـ Tesseract من التعرف على النصوص بعدة لغات بموثوقية عالية. لتعزيز سلامة البيانات أكثر، توفر المكتبة درجات الثقة لكل كلمة تم التعرف عليها، مما يسمح للمطورين بتقييم جودة مخرجات OCR برمجيًا. كمشروع مفتوح المصدر، تقدم RTesseract حلاً فعالًا من حيث التكلفة، قابلًا للتخصيص، وقويًا للفرق التي تتطلع إلى أتمتة عمليات استخراج البيانات وبناء تطبيقات روبي أذكى وتدرك النص.
البدء مع RTesseract
الطريقة الموصى بها لتثبيت RTesseract هي استخدام Rubygems. يرجى استخدام الأمر التالي للحصول على تثبيت سلس.
تثبيت RTesseract عبر Rubygems
$ gem install rtesseract تثبيت RTesseract عبر GitHub
git clone https://github.com/dannnylo/rtesseract.git يمكنك تنزيل المكتبة المشتركة المجمعة من مستودع GitHub.
تحويل الصورة إلى نص عبر واجهة برمجة تطبيقات Ruby
تُسهل مكتبة RTesseract على المطورين تحميل الصورة وتحويلها إلى نص داخل تطبيقات Ruby. أبسط حالة استخدام هي تحويل الصورة إلى سلسلة نصية. باستخدام بضع أسطر من الشيفرة فقط، يمكنك استخراج النص من ملف الصورة. مثال الشيفرة التالي يقوم بتحميل الصورة ومعالجتها باستخدام Tesseract، ويعيد النص المُعترف به كسلسلة Ruby باستخدام أوامر Ruby.
كيف تقوم بتحميل صورة وتحويلها إلى نص عبر واجهة برمجة تطبيقات Ruby؟
require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"
تحويل الصورة إلى PDF قابل للبحث عبر Ruby
توفر مكتبة RTesseract المفتوحة المصدر دعمًا كاملاً لتحويل الصورة إلى ملف PDF قابل للبحث، مع الحفاظ على تخطيط الصورة وألوانها داخل تطبيقات Ruby. المثال التالي يوضح كيف يمكن لمطوري البرمجيات تحميل وإنشاء مستند PDF قابل للبحث من الصور باستخدام أوامر Ruby.
كيف تقوم بتحويل صورة JPEG إلى ملف PDF قابل للبحث عبر مكتبة Ruby؟
require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)
تكوين مخصص لـ Tesseract
تتيح مكتبة RTesseract المفتوحة المصدر للمتخصصين في البرمجيات ضبط إعدادات Tesseract، مثل اللغة، وضع تقسيم الصفحة، تقييد OCR للتعرف على الأرقام، ووضع محرك OCR. يتيح لك ذلك تحسين عملية OCR للحصول على دقة أعلى. يمكنك تخصيص إعدادات Tesseract باستخدام خيار config. في المثال التالي، يتم تعيين psm (وضع تقسيم الصفحة) إلى 6، و oem (وضع محرك OCR) إلى 1.
كيف تقوم بتخصيص إعدادات Tesseract داخل تطبيقات Ruby؟
image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s
puts text
دعم متعدد اللغات
إذا كانت صورتك تحتوي على نص بلغة معينة، يمكنك تحسين الدقة عن طريق تحديد اللغة. تدعم المكتبة لغات مثل الإنجليزية (الافتراضية)، الألمانية، الفرنسية، الإيطالية، الهولندية، البرتغالية، الإسبانية، الفيتنامية، وما إلى ذلك. يرجى التأكد من تثبيت حزمة اللغة المقابلة مع Tesseract. في المثال التالي تم ضبط خيار lang على 'fra' للفرنسية. يمكنك استخدام أي رمز لغة يدعمه Tesseract
كيف تقوم بتحويل الصورة إلى نص بلغات أخرى عبر مكتبة Ruby؟
image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s
puts text