1. Prodotti
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

Libreria Ruby gratuita per convertire Immagini in Testo e PDF Ricercabili

Libreria OCR Ruby open source che consente agli sviluppatori software di eseguire il riconoscimento ottico dei caratteri per estrarre testo da documenti scansionati, immagini o anche screenshot

Che cos'è RTesseract?

La Riconoscimento Ottico dei Caratteri (OCR) funge da ponte trasformativo tra i media visivi e i dati digitali, consentendo alle macchine di estrarre testo da immagini e documenti scannerizzati con precisione. Per gli sviluppatori all'interno dell'ecosistema Ruby, la libreria open source RTesseract offre un gateway ad alta efficienza alla potenza del motore OCR Tesseract. Originariamente sviluppato da Hewlett-Packard e successivamente perfezionato da Google, Tesseract è ampiamente riconosciuto come una soluzione di punta per la conversione da immagine a testo. Agendo come un'interfaccia sofisticata, RTesseract permette l'integrazione senza soluzione di continuità di Tesseract OCR in qualsiasi progetto Ruby, eliminando la necessità di gestire manualmente complesse interazioni da riga di comando, mantenendo al contempo l'accuratezza richiesta per la digitalizzazione di documenti di livello professionale.

Oltre alla sua facilità d'uso, RTesseract è una libreria Ruby versatile progettata per supportare un'ampia gamma di formati immagine, tra cui PNG, JPEG, BMP e TIFF. Questa flessibilità garantisce la compatibilità con praticamente qualsiasi fonte visiva, mentre la capacità di sfruttare i file di dati globali di Tesseract consente il riconoscimento del testo multilingue con alta affidabilità. Per migliorare ulteriormente l'integrità dei dati, la libreria fornisce punteggi di confidenza per ogni parola riconosciuta, permettendo agli sviluppatori di valutare programmaticamente la qualità dell'output OCR. Come progetto open source, RTesseract offre una soluzione economica, personalizzabile e robusta per i team che desiderano automatizzare i flussi di estrazione dati e creare applicazioni Ruby più intelligenti e consapevoli del testo.

Previous Next

Iniziare con RTesseract

Il modo consigliato per installare RTesseract è utilizzare Rubygems. Si prega di usare il comando seguente per un'installazione senza problemi.

Installa RTesseract tramite Rubygems

$ gem install rtesseract 

Installa RTesseract tramite GitHub

 git clone https://github.com/dannnylo/rtesseract.git  

È possibile scaricare la libreria condivisa compilata dal repository GitHub.

Conversione da immagine a testo tramite API Ruby

La libreria RTesseract semplifica per gli sviluppatori il caricamento e la conversione di un'immagine in testo all'interno delle applicazioni Ruby. Il caso d'uso più semplice è convertire un'immagine in una stringa di testo. Con poche righe di codice, è possibile estrarre il testo da un file immagine. Il seguente esempio di codice carica l'immagine e la elabora con Tesseract, restituendo il testo riconosciuto come una stringa Ruby usando comandi Ruby.

Come caricare un'immagine e convertirla in testo tramite l'API Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Conversione di immagini in PDF ricercabile tramite Ruby

La libreria open source RTesseract offre supporto completo per convertire un'immagine in un PDF ricercabile, preservando il layout e i colori dell'immagine all'interno delle applicazioni Ruby. Il seguente esempio dimostra come gli sviluppatori software possano caricare e generare un documento PDF ricercabile da immagini usando comandi Ruby.

Come convertire un'immagine JPEG in un file PDF ricercabile tramite la libreria Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Configurazione personalizzata per Tesseract

La libreria open source RTesseract consente ai professionisti del software di configurare le impostazioni di Tesseract, come lingua, modalità di segmentazione della pagina, limitare l'OCR al riconoscimento di cifre e la modalità del motore OCR. Questo permette di perfezionare il processo di OCR per una maggiore precisione. È possibile personalizzare le impostazioni di Tesseract usando l'opzione config. Nell'esempio seguente, psm (modalità di segmentazione della pagina) è impostato a 6 e oem (modalità del motore OCR) è impostato a 1.

Come personalizzare le impostazioni di Tesseract all'interno delle app Ruby?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

Supporto multilingua

Se la tua immagine contiene testo in una lingua specifica, puoi migliorare la precisione specificando la lingua. La libreria supporta lingue come l'inglese (predefinito), tedesco, francese, italiano, olandese, portoghese, spagnolo, vietnamita e così via. Assicurati che il relativo pacchetto linguistico sia installato con Tesseract. Nell'esempio seguente l'opzione lang è impostata su 'fra' per il francese. Puoi utilizzare qualsiasi codice lingua supportato da Tesseract

Come convertire un'immagine in testo in altre lingue tramite la libreria Ruby?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 Italiano