Безплатна Ruby библиотека за преобразуване на изображение в текст и търсим PDF файлове
Отворена Ruby OCR библиотека, която позволява на софтуерните разработчици да извършват оптично разпознаване на знаци, за да извличат текст от сканирани документи, изображения или дори екранни снимки
Какво е RTesseract?
Оптичното разпознаване на знаци (OCR) служи като трансформативен мост между визуалните медии и цифровите данни, позволявайки на машините с прецизност да извличат текст от изображения и сканирани документи. За разработчиците в екосистемата на Ruby, отворената библиотека RTesseract предоставя високоефективен достъп до мощността на OCR двигателя Tesseract. Първоначално създаден от Hewlett-Packard и по-късно усъвършенстван от Google, Tesseract е широко признат като водещо решение за конвертиране на изображения в текст. Действайки като изискан интерфейс, RTesseract позволява безпроблемната интеграция на Tesseract OCR във всеки Ruby проект, премахвайки необходимостта от ръчно управление на сложни командни редове, като същевременно запазва точността, необходима за професионално дигитализиране на документи.
Освен лесната си употреба, RTesseract е гъвкава Ruby библиотека, създадена да поддържа широк набор от формати за изображения, включително PNG, JPEG, BMP и TIFF. Тази гъвкавост осигурява съвместимост с почти всеки визуален източник, докато способността й да използва глобалните данни на Tesseract позволява разпознаване на текст на множество езици с висока надеждност. За да подобри още повече целостта на данните, библиотеката предоставя оценки за увереност за всяка разпозната дума, позволявайки на разработчиците програмено да оценяват качеството на OCR изхода. Като проект с отворен код, RTesseract предлага икономично, персонализируемо и стабилно решение за екипи, които искат да автоматизират процесите по извличане на данни и да създават по‑умни, текстово‑осъзнати Ruby приложения.
Започване с RTesseract
Препоръчителният начин за инсталиране на RTesseract е чрез Rubygems. Моля, използвайте следната команда за гладка инсталация.
Инсталирайте RTesseract чрез Rubygems
$ gem install rtesseract Инсталирайте RTesseract чрез GitHub
git clone https://github.com/dannnylo/rtesseract.git Можете да изтеглите компилираната споделена библиотека от GitHub хранилището.
Конвертиране на изображение в текст чрез Ruby API
Библиотеката RTesseract улеснява разработчиците да зареждат и конвертират изображение в текст в рамките на Ruby приложения. Най‑простият случай на употреба е конвертирането на изображение в низ от текст. С няколко реда код можете да извлечете текста от файл с изображение. Следният примерен код зарежда изображението и го обработва с Tesseract, връщайки разпознатия текст като Ruby низ, използвайки Ruby команди.
Как да заредим изображение и да го конвертираме в текст чрез Ruby API?
require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"
Конвертиране на изображение в търсим PDF чрез Ruby
Отворената библиотека RTesseract предоставя пълна поддръжка за конвертиране на изображение в търсим PDF, запазвайки оформлението и цветовете на изображението в Ruby приложения. Следният пример демонстрира как софтуерните разработчици могат да заредят и генерират търсим PDF документ от изображения, използвайки Ruby команди.
Как да конвертираме JPEG изображение в търсим файл PDF чрез Ruby библиотека?
require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)
Персонализирана конфигурация за Tesseract
Отворената библиотека RTesseract позволява на софтуерните професионалисти да конфигурират настройките на Tesseract, като език, режим на сегментиране на страницата, ограничаване на OCR само до разпознаване на цифри и режим на OCR двигателя. Това ви дава възможност да фино настроите процеса на OCR за по‑висока точност. Можете да персонализирате настройките на Tesseract, използвайки опцията config. В следния пример psm (режим на сегментиране на страницата) е зададен на 6, а oem (режим на OCR двигателя) е зададен на 1.
Как да персонализираме настройките на Tesseract в Ruby приложения?
image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s
puts text
Поддръжка на множество езици
Ако вашето изображение съдържа текст на конкретен език, можете да подобрите точността, като посочите езика. Библиотеката поддържа езици като английски (по подразбиране), немски, френски, италиански, холандски, португалски, испански, виетнамски и др. Моля, уверете се, че съответният езиков пакет е инсталиран с Tesseract. В следния пример опцията lang е зададена на 'fra' за френски. Можете да използвате всеки езиков код, поддържан от Tesseract.
Как да конвертираме изображение в текст на други езици чрез Ruby библиотека?
image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s
puts text