1. Termékek
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

Ingyenes Ruby könyvtár képek szöveggé és kereshető PDF‑kké konvertálásához

Nyílt forráskódú Ruby OCR könyvtár, amely lehetővé teszi a szoftverfejlesztők számára az optikai karakterfelismerést, hogy szöveget nyerjenek ki beolvasott dokumentumokból, képekből vagy akár képernyőképekből

Mi az RTesseract?

Az optikai karakterfelismerés (OCR) átalakító hídként szolgál a vizuális média és a digitális adatok között, lehetővé téve a gépek számára, hogy pontosan szöveget nyerjenek ki képekből és beolvasott dokumentumokból. A Ruby ökoszisztéma fejlesztői számára a nyílt forráskódú RTesseract könyvtár hatékony átjárót biztosít a Tesseract OCR motor erejéhez. Eredetileg a Hewlett-Packard fejlesztette, majd a Google tovább finomította, a Tesseractot széles körben elismerik, mint a képről szövegre átalakítás elsőrangú megoldását. A kifinomult interfészként működő RTesseract lehetővé teszi a Tesseract OCR zökkenőmentes integrálását bármely Ruby projektbe, kiküszöbölve a bonyolult parancssori műveletek kézi kezelésének szükségességét, miközben megőrzi a professzionális szintű dokumentumdigitalizáláshoz szükséges pontosságot.

A könnyű használhatóságán túl, az RTesseract egy sokoldalú Ruby könyvtár, amelyet úgy terveztek, hogy széles körű képfájlformátumokat támogasson, beleértve a PNG, JPEG, BMP és TIFF formátumokat. Ez a rugalmasság biztosítja a kompatibilitást gyakorlatilag bármely vizuális forrással, miközben a Tesseract globális adatfájljainak felhasználásával többnyelvű szövegfelismerést tesz lehetővé magas megbízhatósággal. A adatintegritás további javítása érdekében a könyvtár bizalmi pontszámokat biztosít minden felismert szóhoz, lehetővé téve a fejlesztők számára, hogy programozottan értékeljék az OCR kimenet minőségét. Nyílt forráskódú projektként az RTesseract költséghatékony, testreszabható és robusztus megoldást kínál azoknak a csapatoknak, akik adatkinyerési munkafolyamatokat szeretnének automatizálni és okosabb, szövegérzékeny Ruby alkalmazásokat építeni.

Previous Next

Az RTesseract használatának megkezdése

Az ajánlott módja az RTesseract telepítésének a Rubygems használata. Kérjük, használja a következő parancsot a zökkenőmentes telepítéshez.

RTesseract telepítése Rubygems használatával

$ gem install rtesseract 

RTesseract telepítése GitHub használatával

 git clone https://github.com/dannnylo/rtesseract.git  

A lefordított megosztott könyvtárat letöltheti a GitHub tárolóból.

Kép szöveggé konvertálása Ruby API-n keresztül

Az RTesseract könyvtár megkönnyíti a fejlesztők számára, hogy képet töltsenek be és alakítsanak át szöveggé Ruby alkalmazásokon belül. A legegyszerűbb felhasználási eset a kép szöveggé konvertálása. Néhány kódsorral ki tudod nyerni a szöveget egy képfájlból. Az alábbi kódrészlet betölti a képet, és a Tesseracttal feldolgozva visszaadja a felismert szöveget Ruby karakterláncként Ruby parancsok használatával.

Hogyan töltsünk be egy képet, és alakítsuk szöveggé a Ruby API segítségével?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Kép konvertálása kereshető PDF-be Ruby-val

Az nyílt forráskódú RTesseract könyvtár teljes támogatást nyújt a kép kereshető PDF‑vé konvertálásához, megőrizve a kép elrendezését és színeit Ruby alkalmazásokon belül. A következő példa bemutatja, hogyan tudnak a szoftverfejlesztők Ruby parancsokkal betölteni és egy kereshető PDF dokumentumot generálni a képekből.

Hogyan alakítsunk egy JPEG képet kereshető PDF-fájlra Ruby könyvtár segítségével?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Egyéni konfiguráció a Tesseract számára

Az nyílt forráskódú RTesseract könyvtár lehetővé teszi a szoftveres szakemberek számára, hogy beállítsák a Tesseract konfigurációját, például a nyelvet, az oldal szegmentálási módot, az OCR korlátozását csak számjegyfelismerésre és az OCR motor módját. Ez lehetővé teszi az OCR folyamat finomhangolását a jobb pontosság érdekében. A Tesseract beállításait a config opcióval testreszabhatod. Az alábbi példában a psm (oldal szegmentálási mód) 6-ra, az oem (OCR motor mód) pedig 1-re van állítva.

Hogyan testre szabhatjuk a Tesseract beállításait Ruby alkalmazásokban?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

Többnyelvű támogatás

Ha a képed szöveget tartalmaz egy adott nyelven, a pontosságot javíthatod a nyelv megadásával. A könyvtár támogatja a nyelveket, mint például az angol (alapértelmezett), német, francia, olasz, holland, portugál, spanyol, vietnami és így tovább. Kérjük, győződj meg róla, hogy a megfelelő nyelvi csomag telepítve van a Tesseracttal. Az alábbi példában a lang opció 'fra'-ra van állítva a francia nyelvhez. Bármilyen, a Tesseract által támogatott nyelvkódot használhatsz.

Hogyan alakítsunk képet szöveggé más nyelveken a Ruby könyvtár segítségével?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 Magyar