1. Produkty
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

Darmowa biblioteka Ruby do konwertowania obrazu na tekst i przeszukiwalne PDF‑y

Otwarta biblioteka Ruby OCR, która umożliwia programistom wykonywanie rozpoznawania znaków optycznych w celu wyodrębnienia tekstu ze skanowanych dokumentów, obrazów lub nawet zrzutów ekranu

Co to jest RTesseract?

Rozpoznawanie znaków optycznych (OCR) pełni rolę transformacyjnego mostu między mediami wizualnymi a danymi cyfrowymi, umożliwiając maszynom precyzyjne wyodrębnianie tekstu z obrazów i zeskanowanych dokumentów. Dla programistów w ekosystemie Ruby, otwarto‑źródłowa biblioteka RTesseract zapewnia wysokowydajny dostęp do mocy silnika OCR Tesseract. Pierwotnie opracowany przez Hewlett‑Packard i dalej udoskonalany przez Google, Tesseract jest powszechnie uznawany za wiodące rozwiązanie w konwersji obrazu na tekst. Działając jako zaawansowany interfejs, RTesseract umożliwia płynną integrację Tesseract OCR w każdym projekcie Ruby, eliminując konieczność ręcznego zarządzania złożonymi interakcjami wiersza poleceń, jednocześnie zachowując dokładność niezbędną do profesjonalnej digitalizacji dokumentów.

Poza łatwością użycia, RTesseract jest wszechstronną biblioteką Ruby zaprojektowaną do obsługi szerokiej gamy formatów obrazów, w tym PNG, JPEG, BMP i TIFF. Ta elastyczność zapewnia kompatybilność praktycznie z każdym źródłem wizualnym, a możliwość wykorzystania globalnych plików danych Tesseract pozwala na rozpoznawanie tekstu w wielu językach z wysoką niezawodnością. Aby dodatkowo zwiększyć integralność danych, biblioteka dostarcza wskaźniki pewności dla każdego rozpoznanego słowa, co umożliwia programistom programowe ocenianie jakości wyniku OCR. Jako projekt open-source, RTesseract oferuje opłacalne, konfigurowalne i solidne rozwiązanie dla zespołów, które chcą automatyzować przepływy ekstrakcji danych i budować inteligentniejsze, świadome tekstu aplikacje Ruby.

Previous Next

Rozpoczęcie pracy z RTesseract

Zalecany sposób instalacji RTesseract to użycie Rubygems. Proszę użyć poniższego polecenia, aby przeprowadzić płynną instalację.

Zainstaluj RTesseract za pomocą Rubygems

$ gem install rtesseract 

Zainstaluj RTesseract za pomocą GitHub

 git clone https://github.com/dannnylo/rtesseract.git  

Możesz pobrać skompilowaną bibliotekę współdzieloną z repozytorium GitHub.

Konwersja obrazu na tekst za pomocą API Ruby

Biblioteka RTesseract ułatwia programistom ładowanie i konwertowanie obrazu na tekst w aplikacjach Ruby. Najprostszy przypadek użycia to konwersja obrazu na ciąg tekstowy. Dzięki kilku liniom kodu możesz wyodrębnić tekst z pliku obrazu. Poniższy przykład kodu ładuje obraz i przetwarza go za pomocą Tesseract, zwracając rozpoznany tekst jako ciąg Ruby przy użyciu poleceń Ruby.

Jak załadować obraz i przekonwertować go na tekst za pomocą API Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Konwersja obrazu do przeszukiwalnego PDF za pomocą Ruby

Biblioteka open source RTesseract zapewnia pełne wsparcie dla konwersji obrazu do przeszukiwalnego PDF, zachowując układ i kolory obrazu w aplikacjach Ruby. Poniższy przykład pokazuje, jak programiści mogą załadować i wygenerować przeszukiwalny dokument PDF z obrazów przy użyciu poleceń Ruby.

Jak przekonwertować obraz JPEG na przeszukiwalny plik PDF za pomocą biblioteki Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Niestandardowa konfiguracja dla Tesseract

Biblioteka open source RTesseract umożliwia specjalistom oprogramowania konfigurowanie ustawień Tesseract, takich jak język, tryb segmentacji strony, ograniczenie OCR do rozpoznawania cyfr oraz tryb silnika OCR. Dzięki temu możesz precyzyjnie dostroić proces OCR w celu uzyskania lepszej dokładności. Ustawienia Tesseract możesz dostosować za pomocą opcji config. W poniższym przykładzie psm (tryb segmentacji strony) jest ustawiony na 6, a oem (tryb silnika OCR) na 1.

Jak dostosować ustawienia Tesseract w aplikacjach Ruby?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

Wsparcie wielojęzyczne

Jeśli Twój obraz zawiera tekst w określonym języku, możesz poprawić dokładność, określając język. Biblioteka obsługuje języki takie jak angielski (domyślnie), niemiecki, francuski, włoski, holenderski, portugalski, hiszpański, wietnamski i tak dalej. Upewnij się, że odpowiedni pakiet językowy jest zainstalowany wraz z Tesseract. W poniższym przykładzie opcja lang jest ustawiona na 'fra' dla francuskiego. Możesz użyć dowolnego kodu języka obsługiwanego przez Tesseract.

Jak przekonwertować obraz na tekst w innych językach za pomocą biblioteki Ruby?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 Polski