1. Produse
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

Bibliotecă Ruby gratuită pentru a converti imaginea în text și PDF-uri căutabile

Bibliotecă Ruby OCR open source care permite dezvoltatorilor de software să efectueze recunoaștere optică de caractere pentru a extrage text din documente scanate, imagini sau chiar capturi de ecran

Ce este RTesseract?

Recunoașterea optică a caracterelor (OCR) servește ca o punte transformatoare între media vizuală și datele digitale, permițând mașinilor să extragă textul din imagini și documente scanate cu precizie. Pentru dezvoltatorii din ecosistemul Ruby, biblioteca open source RTesseract oferă o poartă de înaltă eficiență către puterea motorului OCR Tesseract. Inițial dezvoltată de Hewlett-Packard și perfecționată ulterior de Google, Tesseract este recunoscută pe scară largă ca o soluție de top pentru conversia imagine-text. Acționând ca o interfață sofisticată, RTesseract permite integrarea fără probleme a OCR Tesseract în orice proiect Ruby, eliminând necesitatea gestionării manuale a interacțiunilor complexe din linia de comandă, menținând în același timp acuratețea necesară pentru digitizarea documentelor la nivel profesional.

Dincolo de ușurința de utilizare, RTesseract este o bibliotecă Ruby versatilă, concepută pentru a suporta o gamă extinsă de formate de imagini, inclusiv PNG, JPEG, BMP și TIFF. Această flexibilitate asigură compatibilitatea cu practic orice sursă vizuală, în timp ce capacitatea sa de a exploata fișierele de date globale ale Tesseract permite recunoașterea textului în mai multe limbi cu o fiabilitate ridicată. Pentru a spori integritatea datelor, biblioteca furnizează scoruri de încredere pentru fiecare cuvânt recunoscut, permițând dezvoltatorilor să evalueze programatic calitatea rezultatului OCR. Ca proiect open-source, RTesseract oferă o soluție rentabilă, personalizabilă și robustă pentru echipele care doresc să automatizeze fluxurile de extragere a datelor și să construiască aplicații Ruby mai inteligente, conștiente de text.

Previous Next

Începerea cu RTesseract

Modul recomandat de instalare a RTesseract este prin Rubygems. Vă rugăm să utilizați comanda următoare pentru o instalare fără probleme.

Instalați RTesseract prin Rubygems

$ gem install rtesseract 

Instalați RTesseract prin GitHub

 git clone https://github.com/dannnylo/rtesseract.git  

Puteți descărca biblioteca partajată compilată de pe depozitul GitHub.

Conversie imagine în text prin API Ruby

Biblioteca RTesseract facilitează dezvoltatorilor încărcarea și conversia unei imagini în text în cadrul aplicațiilor Ruby. Cel mai simplu caz de utilizare este conversia unei imagini într-un șir de text. Cu doar câteva linii de cod, poți extrage textul dintr-un fișier imagine. Exemplul de cod de mai jos încarcă imaginea și o procesează cu Tesseract, returnând textul recunoscut ca un șir Ruby utilizând comenzi Ruby.

Cum să încărcați o imagine și să o convertiți în text prin API-ul Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Conversie imagine în PDF căutabil prin Ruby

Biblioteca open source RTesseract oferă suport complet pentru conversia unei imagini într-un PDF căutabil, păstrând aspectul și culorile imaginii în cadrul aplicațiilor Ruby. Exemplul de mai jos demonstrează cum dezvoltatorii pot încărca și genera un document PDF căutabil din imagini utilizând comenzi Ruby.

Cum să convertiți o imagine JPEG într-un fișier PDF căutabil prin biblioteca Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Configurare personalizată pentru Tesseract

Biblioteca open source RTesseract permite profesioniștilor din domeniul software să configureze setările Tesseract, cum ar fi limba, modul de segmentare a paginii, restricționarea OCR-ului la recunoașterea cifrelor și modul motorului OCR. Acest lucru îți permite să ajustezi procesul OCR pentru o acuratețe mai bună. Poți personaliza setările Tesseract utilizând opțiunea config. În exemplul de mai jos, psm (modul de segmentare a paginii) este setat la 6, iar oem (modul motorului OCR) este setat la 1.

Cum să personalizați setările Tesseract în aplicațiile Ruby?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

Suport multilingv

Dacă imaginea dvs. conține text într-o limbă specifică, puteți îmbunătăți acuratețea specificând limba. Biblioteca suportă limbi precum engleza (implicit), germană, franceză, italiană, olandeză, portugheză, spaniolă, vietnameză etc. Asigurați-vă că pachetul de limbă corespunzător este instalat împreună cu Tesseract. În exemplul următor, opțiunea lang este setată la 'fra' pentru franceză. Puteți folosi orice cod de limbă suportat de Tesseract.

Cum să convertiți imaginea în text în alte limbi prin biblioteca Ruby?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 Română