1. Produkter
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

Gratis Ruby-bibliotek för att konvertera bild till text och sökbara PDF-filer

Öppen källkod Ruby OCR-bibliotek som gör det möjligt för mjukvaruutvecklare att utföra optisk teckenigenkänning för att extrahera text från skannade dokument, bilder eller till och med skärmdumpar

Vad är RTesseract?

Optisk teckenigenkänning (OCR) fungerar som en transformerande bro mellan visuella medier och digital data, vilket möjliggör för maskiner att exakt extrahera text från bilder och skannade dokument. För utvecklare inom Ruby-ekosystemet erbjuder det öppna källkodsbiblioteket RTesseract en högpresterande åtkomst till kraften i Tesseract OCR-motorn. Ursprungligen utvecklat av Hewlett-Packard och senare förfinat av Google, är Tesseract allmänt erkänt som en förstklassig lösning för bild‑till‑text‑konvertering. Genom att fungera som ett sofistikerat gränssnitt möjliggör RTesseract sömlös integration av Tesseract OCR i vilket Ruby‑projekt som helst, vilket eliminerar behovet av att manuellt hantera komplexa kommandoradsinteraktioner samtidigt som den noggrannhet som krävs för professionell dokumentdigitalisering upprätthålls.

Utöver sin användarvänlighet är RTesseract ett mångsidigt Ruby‑bibliotek som är konstruerat för att stödja ett omfattande urval av bildformat, inklusive PNG, JPEG, BMP och TIFF. Denna flexibilitet säkerställer kompatibilitet med praktiskt taget alla visuella källor, medan dess förmåga att utnyttja Tesseracts globala datafiler möjliggör flerspråkig textigenkänning med hög tillförlitlighet. För att ytterligare förbättra dataintegriteten tillhandahåller biblioteket förtroendescore för varje igenkänt ord, vilket gör det möjligt för utvecklare att programatiskt utvärdera kvaliteten på OCR‑resultatet. Som ett open‑source‑projekt erbjuder RTesseract en kostnadseffektiv, anpassningsbar och robust lösning för team som vill automatisera arbetsflöden för dataextraktion och bygga smartare, textmedvetna Ruby‑applikationer.

Previous Next

Komma igång med RTesseract

Det rekommenderade sättet att installera RTesseract är att använda Rubygems. Använd följande kommando för en smidig installation.

Installera RTesseract via Rubygems

$ gem install rtesseract 

Installera RTesseract via GitHub

 git clone https://github.com/dannnylo/rtesseract.git  

Du kan ladda ner det kompilerade delade biblioteket från GitHub-arkivet.

Bild till text‑konvertering via Ruby API

RTesseract-biblioteket gör det enkelt för utvecklare att ladda och konvertera en bild till text i Ruby-applikationer. Det mest enkla användningsfallet är att konvertera en bild till en textsträng. Med bara några rader kod kan du extrahera text från en bildfil. Följande kodexempel laddar bilden och bearbetar den med Tesseract, och returnerar den igenkända texten som en Ruby-sträng med Ruby-kommandon.

Hur laddar du en bild och konverterar den till text via Ruby API?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Bildkonvertering till sökbar PDF via Ruby

Det öppna RTesseract-biblioteket har fullständigt stöd för att konvertera en bild till en sökbar PDF, samtidigt som bildens layout och färger bevaras i Ruby-applikationer. Följande exempel visar hur mjukvaruutvecklare kan ladda och generera ett sökbart PDF-dokument från bilder med Ruby-kommandon.

Hur konverterar du en JPEG-bild till en sökbar PDF-fil via Ruby-biblioteket?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Anpassad konfiguration för Tesseract

Det öppna RTesseract-biblioteket låter mjukvaruprofessionella konfigurera Tesseracts inställningar, såsom språk, sidsegmenteringsläge, begränsa OCR till sifferigenkänning och OCR-motormodell. Detta gör att du kan finjustera OCR-processen för bättre noggrannhet. Du kan anpassa Tesseracts inställningar med konfigurationsalternativet. I följande exempel är psm (sidsegmenteringsläge) satt till 6 och oem (OCR-motormodell) satt till 1.

Hur anpassar du Tesseracts inställningar i Ruby-appar?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

Flerspråkigt stöd

Om din bild innehåller text på ett specifikt språk kan du förbättra noggrannheten genom att ange språket. Biblioteket stöder språk som engelska (standard), tyska, franska, italienska, nederländska, portugisiska, spanska, vietnamesiska med mera. Se till att motsvarande språkpaket är installerat med Tesseract. I följande exempel är alternativet lang satt till 'fra' för franska. Du kan använda vilken språk‑kod som helst som stöds av Tesseract.

Hur konverterar du en bild till text på andra språk via Ruby-biblioteket?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 Svenska