Bezplatná Ruby knihovna pro převod obrázku na text a prohledávatelná PDF
Open source Ruby OCR knihovna, která umožňuje vývojářům provádět optické rozpoznávání znaků pro extrakci textu ze skenovaných dokumentů, obrázků nebo dokonce snímků obrazovky
Co je RTesseract?
Optické rozpoznávání znaků (OCR) slouží jako transformační most mezi vizuálními médii a digitálními daty, umožňující strojům přesně extrahovat text z obrázků a skenovaných dokumentů. Pro vývojáře v ekosystému Ruby poskytuje open source knihovna RTesseract vysoce efektivní bránu k síle OCR enginu Tesseract. Původně vyvinutý společností Hewlett-Packard a dále vylepšený společností Google, je Tesseract široce uznáván jako špičkové řešení pro převod obrazu na text. Díky tomu, že funguje jako sofistikované rozhraní, umožňuje RTesseract bezproblémovou integraci Tesseract OCR do jakéhokoli Ruby projektu, čímž eliminuje potřebu ručně spravovat složité příkazy v příkazovém řádku a zachovává přesnost potřebnou pro profesionální digitalizaci dokumentů.
Vedle své snadné použitelnosti je RTesseract všestranná knihovna Ruby navržená tak, aby podporovala širokou škálu formátů obrázků, včetně PNG, JPEG, BMP a TIFF. Tato flexibilita zajišťuje kompatibilitu s prakticky jakýmkoli vizuálním zdrojem, zatímco schopnost využívat globální datové soubory Tesseractu umožňuje rozpoznávání textu v několika jazycích s vysokou spolehlivostí. Pro další zvýšení integrity dat knihovna poskytuje skóre důvěry pro každé rozpoznané slovo, což vývojářům umožňuje programově vyhodnocovat kvalitu výstupu OCR. Jako open-source projekt nabízí RTesseract nákladově efektivní, přizpůsobitelné a robustní řešení pro týmy, které chtějí automatizovat workflow extrakce dat a vytvářet chytřejší, textově uvědomělé Ruby aplikace.
Začínáme s RTesseract
Doporučený způsob instalace RTesseract je pomocí Rubygems. Pro hladkou instalaci použijte následující příkaz.
Nainstalujte RTesseract přes Rubygems
$ gem install rtesseract Nainstalujte RTesseract přes GitHub
git clone https://github.com/dannnylo/rtesseract.git Můžete si stáhnout zkompilovanou sdílenou knihovnu z GitHub repozitáře.
Převod obrazu na text pomocí Ruby API
Knihovna RTesseract usnadňuje vývojářům načítání a převod obrázku na text v Ruby aplikacích. Nejsnazší případ použití je převod obrázku na řetězec textu. Pouhých několik řádků kódu vám umožní extrahovat text z obrázkového souboru. Následující ukázkový kód načte obrázek a zpracuje jej pomocí Tesseractu, přičemž vrátí rozpoznaný text jako Ruby řetězec pomocí Ruby příkazů.
Jak načíst obrázek a převést jej na text pomocí Ruby API?
require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"
Převod obrázku na prohledávatelný PDF pomocí Ruby
Open source knihovna RTesseract poskytuje kompletní podporu pro převod obrázku na prohledávatelný PDF, zachovávající rozložení a barvy obrázku v Ruby aplikacích. Následující příklad ukazuje, jak vývojáři mohou načíst a vytvořit prohledávatelný PDF dokument z obrázků pomocí Ruby příkazů.
Jak převést JPEG obrázek na prohledávatelný PDF soubor pomocí Ruby knihovny?
require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)
Vlastní konfigurace pro Tesseract
Open source knihovna RTesseract umožňuje softwarovým profesionálům konfigurovat nastavení Tesseractu, jako je jazyk, režim segmentace stránky, omezení OCR na rozpoznávání číslic a režim OCR enginu. To vám umožní doladit proces OCR pro vyšší přesnost. Nastavení Tesseractu můžete přizpůsobit pomocí volby config. V následujícím příkladu je psm (režim segmentace stránky) nastaven na 6 a oem (režim OCR enginu) na 1.
Jak přizpůsobit nastavení Tesseractu v Ruby aplikacích?
image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s
puts text
Podpora více jazyků
Pokud váš obrázek obsahuje text v konkrétním jazyce, můžete zvýšit přesnost zadáním jazyka. Knihovna podporuje jazyky jako angličtina (výchozí), němčina, francouzština, italština, holandština, portugalština, španělština, vietnamština a další. Ujistěte se, že odpovídající jazykový balíček je nainstalován s Tesseract. V následujícím příkladu je volba lang nastavena na 'fra' pro francouzštinu. Můžete použít jakýkoli jazykový kód podporovaný Tesseract.
Jak převést obrázek na text v jiných jazycích pomocí Ruby knihovny?
image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s
puts text