Biblioteca Ruby gratuita para convertir Imagen a Texto y PDFs buscables
Biblioteca Ruby OCR de código abierto que permite a los desarrolladores de software realizar Reconocimiento Óptico de Caracteres para extraer texto de documentos escaneados, imágenes o incluso capturas de pantalla
¿Qué es RTesseract?
El reconocimiento óptico de caracteres (OCR) sirve como un puente transformador entre los medios visuales y los datos digitales, permitiendo a las máquinas extraer texto de imágenes y documentos escaneados con precisión. Para los desarrolladores dentro del ecosistema Ruby, la biblioteca de código abierto RTesseract ofrece una puerta de alta eficiencia al poder del motor OCR Tesseract. Originalmente creado por Hewlett-Packard y posteriormente refinado por Google, Tesseract es ampliamente reconocido como una solución de primera categoría para la conversión de imagen a texto. Al actuar como una interfaz sofisticada, RTesseract permite la integración fluida de Tesseract OCR en cualquier proyecto Ruby, eliminando la necesidad de gestionar manualmente interacciones complejas de línea de comandos mientras se mantiene la precisión requerida para la digitalización de documentos de nivel profesional.
Más allá de su facilidad de uso, RTesseract es una biblioteca Ruby versátil diseñada para admitir una amplia gama de formatos de imagen, incluidos PNG, JPEG, BMP y TIFF. Esta flexibilidad garantiza la compatibilidad con prácticamente cualquier fuente visual, mientras que su capacidad para aprovechar los archivos de datos globales de Tesseract permite el reconocimiento de texto multilingüe con alta fiabilidad. Para mejorar aún más la integridad de los datos, la biblioteca proporciona puntuaciones de confianza para cada palabra reconocida, lo que permite a los desarrolladores evaluar programáticamente la calidad del resultado OCR. Como proyecto de código abierto, RTesseract ofrece una solución rentable, personalizable y robusta para equipos que buscan automatizar flujos de trabajo de extracción de datos y crear aplicaciones Ruby más inteligentes y conscientes del texto.
Comenzando con RTesseract
La forma recomendada de instalar RTesseract es usando Rubygems. Por favor, use el siguiente comando para una instalación sin problemas.
Instalar RTesseract vía Rubygems
$ gem install rtesseract Instalar RTesseract vía GitHub
git clone https://github.com/dannnylo/rtesseract.git Puede descargar la biblioteca compartida compilada del repositorio GitHub.
Conversión de Imagen a Texto mediante la API de Ruby
La biblioteca RTesseract facilita a los desarrolladores cargar y convertir una imagen a texto dentro de aplicaciones Ruby. El caso de uso más sencillo es convertir una imagen en una cadena de texto. Con solo unas pocas líneas de código, puedes extraer texto de un archivo de imagen. El siguiente ejemplo de código carga la imagen y la procesa con Tesseract, devolviendo el texto reconocido como una cadena Ruby usando comandos Ruby.
¿Cómo cargar una imagen y convertirla a texto mediante la API de Ruby?
require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"
Conversión de Imagen a PDF Buscable mediante Ruby
La biblioteca de código abierto RTesseract ha proporcionado soporte completo para convertir una imagen en un PDF buscable, preservando el diseño y los colores de la imagen dentro de aplicaciones Ruby. El siguiente ejemplo muestra cómo los desarrolladores de software pueden cargar y generar un documento PDF buscable a partir de imágenes usando comandos Ruby.
¿Cómo convertir una imagen JPEG a un archivo PDF buscable mediante la biblioteca Ruby?
require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)
Configuración Personalizada para Tesseract
La biblioteca de código abierto RTesseract permite a los profesionales del software configurar los ajustes de Tesseract, como el idioma, el modo de segmentación de página, restringir el OCR al reconocimiento de dígitos y el modo del motor OCR. Esto te permite afinar el proceso de OCR para obtener mayor precisión. Puedes personalizar los ajustes de Tesseract usando la opción config. En el siguiente ejemplo, psm (modo de segmentación de página) se establece en 6, y oem (modo del motor OCR) se establece en 1.
¿Cómo personalizar la configuración de Tesseract dentro de aplicaciones Ruby?
image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s
puts text
Soporte Multilingüe
Si su imagen contiene texto en un idioma específico, puede mejorar la precisión especificando el idioma. La biblioteca admite idiomas como inglés (predeterminado), alemán, francés, italiano, holandés, portugués, español, vietnamita, entre otros. Asegúrese de que el paquete de idioma correspondiente esté instalado con Tesseract. En el siguiente ejemplo, la opción lang se establece en 'fra' para francés. Puede usar cualquier código de idioma compatible con Tesseract.
¿Cómo convertir una imagen a texto en otros idiomas mediante la biblioteca Ruby?
image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s
puts text