1. Producten
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

Gratis Ruby-bibliotheek om afbeelding naar tekst & doorzoekbare PDF's te converteren

Open source Ruby OCR-bibliotheek die softwareontwikkelaars in staat stelt optische tekenherkenning uit te voeren om tekst te extraheren uit gescande documenten, afbeeldingen of zelfs screenshots

Wat is RTesseract?

Optical Character Recognition (OCR) dient als een transformerende brug tussen visuele media en digitale gegevens, waardoor machines nauwkeurig tekst uit afbeeldingen en gescande documenten kunnen extraheren. Voor ontwikkelaars binnen het Ruby-ecosysteem biedt de open‑source RTesseract‑bibliotheek een zeer efficiënte toegangspoort tot de kracht van de Tesseract OCR‑engine. Oorspronkelijk ontwikkeld door Hewlett‑Packard en later verfijnd door Google, wordt Tesseract algemeen erkend als een toonaangevende oplossing voor beeld‑naar‑tekst conversie. Door te fungeren als een geavanceerde interface maakt RTesseract de naadloze integratie van Tesseract OCR in elk Ruby‑project mogelijk, waardoor het handmatig beheren van complexe commandoregelinteracties overbodig wordt, terwijl de nauwkeurigheid behouden blijft die nodig is voor documentdigitalisatie van professionele kwaliteit.

Naast het gebruiksgemak is RTesseract een veelzijdige Ruby-bibliotheek die is ontworpen om een uitgebreide reeks beeldformaten te ondersteunen, waaronder PNG, JPEG, BMP en TIFF. Deze flexibiliteit zorgt voor compatibiliteit met vrijwel elke visuele bron, terwijl het vermogen om Tesseract's globale databestanden te benutten multi-taal tekstherkenning met hoge betrouwbaarheid mogelijk maakt. Om de gegevensintegriteit verder te verbeteren, biedt de bibliotheek vertrouwensscores voor elk herkend woord, waardoor ontwikkelaars de kwaliteit van de OCR-uitvoer programmatisch kunnen evalueren. Als een open-source project biedt RTesseract een kosteneffectieve, aanpasbare en robuuste oplossing voor teams die data-extractieworkflows willen automatiseren en slimmere, tekstbewuste Ruby-applicaties willen bouwen.

Previous Next

Aan de slag met RTesseract

De aanbevolen manier om RTesseract te installeren is via Rubygems. Gebruik alstublieft het volgende commando voor een soepele installatie.

Installeer RTesseract via Rubygems

$ gem install rtesseract 

Installeer RTesseract via GitHub

 git clone https://github.com/dannnylo/rtesseract.git  

U kunt de gecompileerde gedeelde bibliotheek downloaden van de GitHub-repository.

Afbeelding-naar-tekst conversie via Ruby API

De RTesseract-bibliotheek maakt het gemakkelijk voor ontwikkelaars om een afbeelding te laden en om te zetten naar tekst binnen Ruby-toepassingen. Het meest eenvoudige gebruiksscenario is het converteren van een afbeelding naar een tekenreeks. Met slechts een paar regels code kun je tekst uit een afbeeldingsbestand halen. Het onderstaande codevoorbeeld laadt de afbeelding en verwerkt deze met Tesseract, waarbij de herkende tekst wordt geretourneerd als een Ruby-string met behulp van Ruby-commando's.

Hoe laad je een afbeelding en converteer je deze naar tekst via de Ruby API?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Afbeeldingsconversie naar doorzoekbare PDF via Ruby

De open source RTesseract-bibliotheek biedt volledige ondersteuning voor het converteren van een afbeelding naar een doorzoekbare PDF, waarbij de lay-out en kleuren van de afbeelding behouden blijven binnen Ruby-toepassingen. Het volgende voorbeeld laat zien hoe softwareontwikkelaars een doorzoekbaar PDF-document kunnen genereren vanuit afbeeldingen met behulp van Ruby-commando's.

Hoe converteer je een JPEG-afbeelding naar een doorzoekbaar PDF-bestand via de Ruby-bibliotheek?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Aangepaste configuratie voor Tesseract

De open source RTesseract-bibliotheek stelt softwareprofessionals in staat om de instellingen van Tesseract te configureren, zoals taal, paginasegmentatiemodus, OCR beperken tot cijferherkenning en OCR-engine-modus. Dit stelt je in staat om het OCR-proces fijn af te stemmen voor betere nauwkeurigheid. Je kunt de instellingen van Tesseract aanpassen met de config-optie. In het volgende voorbeeld is psm (paginasegmentatiemodus) ingesteld op 6, en oem (OCR-engine-modus) ingesteld op 1.

Hoe pas je de instellingen van Tesseract aan binnen Ruby-apps?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

Ondersteuning voor meerdere talen

Als uw afbeelding tekst bevat in een specifieke taal, kunt u de nauwkeurigheid verbeteren door de taal op te geven. De bibliotheek ondersteunt talen zoals Engels (standaard), Duits, Frans, Italiaans, Nederlands, Portugees, Spaans, Vietnamees, enzovoort. Zorg ervoor dat het bijbehorende taalpakket is geïnstalleerd met Tesseract. In het volgende voorbeeld is de optie lang ingesteld op 'fra' voor Frans. U kunt elke door Tesseract ondersteunde taalcodes gebruiken.

Hoe converteer je een afbeelding naar tekst in andere talen via de Ruby-bibliotheek?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 Dutch