ספרייה חינמית ל‑Ruby להמרת תמונה לטקסט & PDF ניתנים לחיפוש
ספריית OCR קוד פתוח ל‑Ruby המאפשרת למפתחי תוכנה לבצע זיהוי תווים אופטי כדי לחלץ טקסט ממסמכים סרוקים, תמונות, או אפילו צילומי מסך
מהו RTesseract?
זיהוי אופטי של תווים (OCR) משמש כגשר משנה תכלית בין מדיה חזותית לנתונים דיגיטליים, ומאפשר למכונות לחלץ טקסט מתמונות וממסמכים סרוקים בדיוק גבוה. עבור מפתחים במערכת האקולוגית של Ruby, ספריית הקוד הפתוח RTesseract מספקת שער יעיל ביותר לכוח של מנוע ה‑OCR Tesseract. במקור פותחה על ידי Hewlett‑Packard ושופרה על ידי Google, Tesseract מוכרת נרחבת כפתרון מוביל להמרת תמונה לטקסט. באמצעות תפקידה כממשק מתוחכם, RTesseract מאפשר אינטגרציה חלקה של Tesseract OCR לכל פרויקט Ruby, ומבטלת את הצורך לנהל ידנית אינטראקציות מורכבות של שורת פקודה תוך שמירה על הדיוק הנדרש לדיגיטציה של מסמכים ברמת מקצועיות.
מעבר לקלות השימוש שלו, RTesseract היא ספריית Ruby רב‑גונית שנבנתה לתמוך במגוון רחב של פורמטים של תמונות, כולל PNG, JPEG, BMP ו‑TIFF. גמישות זו מבטיחה תאימות עם כמעט כל מקור חזותי, בעוד שהיכולת לנצל את קבצי הנתונים הגלובליים של Tesseract מאפשרת זיהוי טקסט רב‑שפתי באמינות גבוהה. כדי לשפר עוד יותר את שלמות הנתונים, הספרייה מספקת ציוני בטחון עבור כל מילה מזוהה, מה שמאפשר למפתחים להעריך תכנותית את איכות פלט ה‑OCR. כפרויקט קוד פתוח, RTesseract מציעה פתרון חסכוני, ניתן להתאמה ועמיד לצוותים המעוניינים לאוטומט תהליכי חילוץ נתונים ולבנות יישומי Ruby חכמים, מודעים לטקסט.
התחלה עם RTesseract
הדרך המומלצת להתקנת RTesseract היא באמצעות Rubygems. אנא השתמשו בפקודה הבאה להתקנה חלקה.
התקן RTesseract דרך Rubygems
$ gem install rtesseract התקן RTesseract דרך GitHub
git clone https://github.com/dannnylo/rtesseract.git אתם יכולים להוריד את הספרייה המשותפת המהודרת מ‑GitHub.
המרת תמונה לטקסט באמצעות API של Ruby
הספרייה RTesseract מקלה על המפתחים לטעון ולהמיר תמונה לטקסט בתוך יישומי Ruby. המקרה הפשוט ביותר הוא המרת תמונה למחרוזת טקסט. עם כמה שורות קוד בלבד, ניתן לחלץ טקסט מקובץ תמונה. דוגמת הקוד הבאה טוענת את התמונה ומעבדת אותה עם Tesseract, ומחזירה את הטקסט שהזוהה כמחרוזת Ruby באמצעות פקודות Ruby.
איך לטעון תמונה ולהמיר אותה לטקסט באמצעות API של Ruby?
require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"
המרת תמונה ל‑PDF ניתן לחיפוש באמצעות Ruby
הספרייה הפתוחה RTesseract מספקת תמיכה מלאה בהמרת תמונה ל‑PDF שניתן לחיפוש, תוך שמירה על פריסת הצבעים של התמונה בתוך יישומי Ruby. הדוגמה שלהלן מציגה כיצד מפתחים יכולים לטעון וליצור מסמך PDF שניתן לחיפוש מתמונות באמצעות פקודות Ruby.
איך להמיר תמונת JPEG לקובץ PDF שניתן לחיפוש באמצעות ספריית Ruby?
require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)
תצורה מותאמת אישית ל‑Tesseract
הספרייה הפתוחה RTesseract מאפשרת לאנשי מקצוע בתכנה להגדיר את ההגדרות של Tesseract, כגון שפה, מצב חלוקת דפים, הגבלת OCR לזיהוי ספרות ומצב מנוע OCR. זה מאפשר לכוונן את תהליך ה‑OCR לדיוק גבוה יותר. ניתן להתאים את הגדרות Tesseract באמצעות אפשרות ה‑config. בדוגמה שלהלן, psm (מצב חלוקת דפים) מוגדר ל‑6, ו‑oem (מצב מנוע OCR) מוגדר ל‑1.
איך להתאים את הגדרות Tesseract בתוך אפליקציות Ruby?
image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s
puts text
תמיכה בריבוי שפות
אם לתמונה שלך יש טקסט בשפה ספציפית, אתה יכול לשפר את הדיוק על ידי ציון השפה. הספרייה תומכת בשפות כמו אנגלית (ברירת מחדל), גרמנית, צרפתית, איטלקית, הולנדית, פורטוגזית, ספרדית, ויאטנאמית, וכדומה. אנא ודא שחבילת השפה המתאימה מותקנת עם Tesseract. בדוגמה הבאה אפשרות ה‑lang מוגדרת ל‑'fra' עבור הצרפתית. אתה יכול להשתמש בכל קוד שפה הנתמך על ידי Tesseract
איך להמיר תמונה לטקסט בשפות אחרות באמצעות ספריית Ruby?
image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s
puts text