Безкоштовна Ruby бібліотека для перетворення зображень у текст та пошукові PDF
Бібліотека Ruby OCR з відкритим кодом, яка дозволяє розробникам програмного забезпечення виконувати оптичне розпізнавання символів для вилучення тексту зі сканованих документів, зображень або навіть скріншотів
Що таке RTesseract?
Оптичне розпізнавання символів (OCR) служить трансформаційним мостом між візуальними медіа та цифровими даними, дозволяючи машинам точно витягувати текст із зображень та сканованих документів. Для розробників у екосистемі Ruby відкритий бібліотека RTesseract забезпечує високоефективний доступ до потужності OCR-двигуна Tesseract. Спочатку розроблений Hewlett-Packard і подальше вдосконалений Google, Tesseract широко визнаний провідним рішенням для конвертації зображень у текст. Діючи як складний інтерфейс, RTesseract дозволяє безшовну інтеграцію Tesseract OCR у будь-який Ruby‑проект, усуваючи потребу вручну керувати складними командними рядками, зберігаючи точність, необхідну для професійної оцифровки документів.
Окрім простоти використання, RTesseract — це універсальна Ruby‑бібліотека, створена для підтримки широкого спектру форматів зображень, включаючи PNG, JPEG, BMP та TIFF. Така гнучкість забезпечує сумісність практично з будь‑яким візуальним джерелом, а можливість використовувати глобальні файли даних Tesseract дозволяє розпізнавати текст кількома мовами з високою надійністю. Для підвищення цілісності даних бібліотека надає оцінки впевненості для кожного розпізнаного слова, що дозволяє розробникам програмно оцінювати якість результату OCR. Як проєкт з відкритим кодом, RTesseract пропонує економічно вигідне, налаштовуване та надійне рішення для команд, які прагнуть автоматизувати процеси вилучення даних і створювати більш розумні, орієнтовані на текст Ruby‑застосунки.
Початок роботи з RTesseract
Рекомендований спосіб встановлення RTesseract — використання Rubygems. Будь ласка, скористайтеся наступною командою для безпроблемної інсталяції.
Встановити RTesseract через Rubygems
$ gem install rtesseract Встановити RTesseract через GitHub
git clone https://github.com/dannnylo/rtesseract.git Ви можете завантажити скомпільовану спільну бібліотеку з репозиторію GitHub.
Перетворення зображення в текст за допомогою Ruby API
Бібліотека RTesseract спрощує розробникам завантаження та конвертацію зображення в текст у Ruby‑додатках. Найпростіший випадок використання — перетворення зображення у рядок тексту. За кілька рядків коду ви можете витягти текст із файлу зображення. Наведений нижче приклад коду завантажує зображення та обробляє його за допомогою Tesseract, повертаючи розпізнаний текст як Ruby‑рядок за допомогою Ruby‑команд.
Як завантажити зображення та конвертувати його в текст за допомогою Ruby API?
require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"
Перетворення зображення у пошуковий PDF за допомогою Ruby
Відкрита бібліотека RTesseract забезпечує повну підтримку конвертації зображення у пошуковий PDF, зберігаючи макет та кольори зображення у Ruby‑додатках. Наведений нижче приклад демонструє, як розробники програмного забезпечення можуть завантажити та створити пошуковий PDF‑документ із зображень за допомогою Ruby‑команд.
Як конвертувати JPEG-зображення у пошуковий PDF-файл за допомогою Ruby-бібліотеки?
require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)
Користувацька конфігурація для Tesseract
Відкрита бібліотека RTesseract дозволяє ІТ‑фахівцям налаштовувати параметри Tesseract, такі як мова, режим сегментації сторінки, обмеження OCR лише розпізнаванням цифр та режим OCR‑двигуна. Це дає можливість точно налаштувати процес OCR для підвищення точності. Ви можете налаштувати параметри Tesseract за допомогою опції config. У наведеному нижче прикладі psm (режим сегментації сторінки) встановлено в 6, а oem (режим OCR‑двигуна) — в 1.
Як налаштувати параметри Tesseract у Ruby-додатках?
image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s
puts text
Підтримка багатьох мов
Якщо ваше зображення містить текст певною мовою, ви можете підвищити точність, вказавши мову. Бібліотека підтримує такі мови, як англійська (за замовчуванням), німецька, французька, італійська, нідерландська, португальська, іспанська, в’єтнамська тощо. Будь ласка, переконайтеся, що відповідний мовний пакет встановлений разом з Tesseract. У наведеному нижче прикладі параметр lang встановлено на 'fra' для французької. Ви можете використовувати будь‑який код мови, підтримуваний Tesseract.
Як конвертувати зображення в текст іншими мовами за допомогою Ruby-бібліотеки?
image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s
puts text