1. Produtos
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

Biblioteca Ruby Gratuita para Converter Imagem em Texto e PDFs pesquisáveis

Biblioteca Ruby OCR de Código Aberto que Permite a Desenvolvedores de Software Realizar Reconhecimento Óptico de Caracteres para Extrair Texto de Documentos Digitalizados, Imagens ou Até Capturas de Tela

O que é RTesseract?

O Reconhecimento Óptico de Caracteres (OCR) funciona como uma ponte transformadora entre mídia visual e dados digitais, permitindo que máquinas extraiam texto de imagens e documentos escaneados com precisão. Para desenvolvedores dentro do ecossistema Ruby, a biblioteca de código aberto RTesseract oferece um gateway de alta eficiência para o poder do mecanismo Tesseract OCR. Originalmente criado pela Hewlett-Packard e posteriormente refinado pelo Google, o Tesseract é amplamente reconhecido como uma solução de primeira linha para conversão de imagem em texto. Ao atuar como uma interface sofisticada, o RTesseract permite a integração perfeita do Tesseract OCR em qualquer projeto Ruby, eliminando a necessidade de gerenciar manualmente interações complexas de linha de comando, ao mesmo tempo que mantém a precisão necessária para a digitalização de documentos de nível profissional.

Além da sua facilidade de uso, o RTesseract é uma biblioteca Ruby versátil projetada para suportar uma ampla variedade de formatos de imagem, incluindo PNG, JPEG, BMP e TIFF. Essa flexibilidade garante compatibilidade com praticamente qualquer fonte visual, enquanto sua capacidade de aproveitar os arquivos de dados globais do Tesseract permite o reconhecimento de texto multilíngue com alta confiabilidade. Para melhorar ainda mais a integridade dos dados, a biblioteca fornece pontuações de confiança para cada palavra reconhecida, permitindo que os desenvolvedores avaliem programaticamente a qualidade da saída de OCR. Como um projeto de código aberto, o RTesseract oferece uma solução econômica, personalizável e robusta para equipes que desejam automatizar fluxos de trabalho de extração de dados e criar aplicações Ruby mais inteligentes e conscientes de texto.

Previous Next

Começando com RTesseract

A forma recomendada de instalar o RTesseract é usando Rubygems. Por favor, use o comando a seguir para uma instalação tranquila.

Instale o RTesseract via Rubygems

$ gem install rtesseract 

Instale o RTesseract via GitHub

 git clone https://github.com/dannnylo/rtesseract.git  

Você pode baixar a biblioteca compartilhada compilada do repositório GitHub.

Conversão de Imagem para Texto via API Ruby

A biblioteca RTesseract facilita para os desenvolvedores carregar e converter uma imagem em texto dentro de aplicações Ruby. O caso de uso mais simples é converter uma imagem em uma cadeia de texto. Com apenas algumas linhas de código, você pode extrair texto de um arquivo de imagem. O exemplo de código a seguir carrega a imagem e a processa com o Tesseract, retornando o texto reconhecido como uma string Ruby usando comandos Ruby.

Como carregar uma imagem e convertê-la em texto via API Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Conversão de Imagem para PDF pesquisável via Ruby

A biblioteca de código aberto RTesseract oferece suporte completo para converter uma imagem em um PDF pesquisável, preservando o layout e as cores da imagem dentro de aplicações Ruby. O exemplo a seguir demonstra como desenvolvedores de software podem carregar e gerar um documento PDF pesquisável a partir de imagens usando comandos Ruby.

Como converter uma imagem JPEG em um arquivo PDF pesquisável via biblioteca Ruby?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Configuração Personalizada para o Tesseract

A biblioteca de código aberto RTesseract permite que profissionais de software configurem as opções do Tesseract, como idioma, modo de segmentação de página, restrição do OCR ao reconhecimento de dígitos e modo do mecanismo OCR. Isso permite ajustar finamente o processo de OCR para maior precisão. Você pode personalizar as configurações do Tesseract usando a opção config. No exemplo a seguir, psm (modo de segmentação de página) está definido como 6, e oem (modo do mecanismo OCR) está definido como 1.

Como personalizar as configurações do Tesseract dentro de aplicativos Ruby?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

Suporte Multilíngue

Se sua imagem contém texto em um idioma específico, você pode melhorar a precisão especificando o idioma. A biblioteca suporta idiomas como Inglês (padrão), Alemão, Francês, Italiano, Holandês, Português, Espanhol, Vietnamita, entre outros. Certifique‑se de que o pacote de idioma correspondente esteja instalado com o Tesseract. No exemplo a seguir, a opção lang está definida como 'fra' para Francês. Você pode usar qualquer código de idioma suportado pelo Tesseract.

Como converter uma imagem em texto em outros idiomas via biblioteca Ruby?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 Português