1. 제품
  2.   OCR
  3.   Ruby
  4.   RTesseract
 
  

이미지를 텍스트 및 검색 가능한 PDF로 변환하는 무료 Ruby 라이브러리

스캔한 문서, 이미지 또는 스크린샷에서 텍스트를 추출하기 위해 광학 문자 인식을 수행하도록 소프트웨어 개발자를 지원하는 오픈 소스 Ruby OCR 라이브러리

RTesseract란 무엇인가요?

광학 문자 인식(OCR)은 시각 매체와 디지털 데이터 사이의 변혁적인 다리 역할을 하며, 기계가 이미지와 스캔된 문서에서 텍스트를 정밀하게 추출할 수 있게 합니다. Ruby 생태계의 개발자에게 오픈 소스 RTesseract 라이브러리는 Tesseract OCR 엔진의 강력함에 대한 고효율 게이트웨이를 제공합니다. 원래 Hewlett-Packard에서 시작되어 Google이 추가로 개선한 Tesseract는 이미지-텍스트 변환을 위한 최고의 솔루션으로 널리 인정받고 있습니다. 정교한 인터페이스 역할을 함으로써 RTesseract는 복잡한 명령줄 작업을 수동으로 관리할 필요 없이 Tesseract OCR을 모든 Ruby 프로젝트에 원활히 통합할 수 있게 하며, 전문 수준의 문서 디지털화에 필요한 정확성을 유지합니다.

사용 편의성을 넘어, RTesseract는 PNG, JPEG, BMP, TIFF 등 다양한 이미지 포맷을 지원하도록 설계된 다재다능한 Ruby 라이브러리입니다. 이러한 유연성은 사실상 모든 시각적 소스와의 호환성을 보장하며, Tesseract의 글로벌 데이터 파일을 활용하여 다국어 텍스트 인식을 높은 신뢰도로 수행할 수 있습니다. 데이터 무결성을 더욱 강화하기 위해, 라이브러리는 인식된 각 단어에 대한 신뢰도 점수를 제공하여 개발자가 OCR 출력 품질을 프로그래밍적으로 평가할 수 있게 합니다. 오픈소스 프로젝트인 RTesseract는 비용 효율적이고 맞춤형이며 견고한 솔루션을 제공하여 데이터 추출 워크플로를 자동화하고 보다 스마트하고 텍스트 인식이 가능한 Ruby 애플리케이션을 구축하려는 팀에 적합합니다.

Previous Next

RTesseract 시작하기

RTesseract를 설치하는 권장 방법은 Rubygems를 사용하는 것입니다. 원활한 설치를 위해 다음 명령을 사용하십시오.

Rubygems를 통해 RTesseract 설치

$ gem install rtesseract 

GitHub를 통해 RTesseract 설치

 git clone https://github.com/dannnylo/rtesseract.git  

컴파일된 공유 라이브러리를 GitHub 저장소에서 다운로드할 수 있습니다.

Ruby API를 통한 이미지 텍스트 변환

RTesseract 라이브러리는 Ruby 애플리케이션 내에서 개발자가 이미지를 로드하고 텍스트로 변환하는 작업을 쉽게 해줍니다. 가장 직접적인 사용 사례는 이미지를 텍스트 문자열로 변환하는 것입니다. 몇 줄의 코드만으로 이미지 파일에서 텍스트를 추출할 수 있습니다. 다음 코드 예제는 이미지를 로드하고 Tesseract로 처리하여 인식된 텍스트를 Ruby 명령을 사용해 Ruby 문자열로 반환합니다.

Ruby API를 사용하여 이미지를 로드하고 텍스트로 변환하는 방법은?

require 'rtesseract'
image = RTesseract.new("path/to/your_image.jpg")
text = image.to_s
puts "Extracted Text: #{text}"

Ruby를 통한 이미지 검색 가능한 PDF 변환

오픈 소스 RTesseract 라이브러리는 Ruby 애플리케이션 내에서 이미지의 레이아웃과 색상을 보존하면서 이미지를 검색 가능한 PDF로 변환하는 완전한 지원을 제공합니다. 다음 예제는 소프트웨어 개발자가 Ruby 명령을 사용하여 이미지에서 검색 가능한 PDF 문서를 생성하는 방법을 보여줍니다.

Ruby 라이브러리를 사용하여 JPEG 이미지를 검색 가능한 PDF 파일로 변환하는 방법은?

require 'rtesseract'
image = RTesseract.new("path/to/my_image.jpg")
pdf_file = image.to_pdf  # Returns an open file handle for the PDF
File.write("output.pdf", pdf_file.read)

Tesseract 맞춤 설정

오픈 소스 RTesseract 라이브러리를 사용하면 소프트웨어 전문가가 언어, 페이지 분할 모드, OCR을 숫자 인식으로 제한 및 OCR 엔진 모드와 같은 Tesseract 설정을 구성할 수 있습니다. 이를 통해 OCR 프로세스를 미세 조정하여 정확성을 높일 수 있습니다. config 옵션을 사용하여 Tesseract 설정을 맞춤화할 수 있습니다. 다음 예제에서는 psm(페이지 분할 모드)이 6으로, oem(OCR 엔진 모드)이 1으로 설정됩니다.

Ruby 애플리케이션 내에서 Tesseract 설정을 맞춤화하는 방법은?

image = RTesseract.new('path/to/image.png', config: { psm: 6, oem: 1 })
text = image.to_s

puts text

다중 언어 지원

이미지에 특정 언어의 텍스트가 포함된 경우, 언어를 지정하여 정확성을 높일 수 있습니다. 이 라이브러리는 영어(기본), 독일어, 프랑스어, 이탈리아어, 네덜란드어, 포르투갈어, 스페인어, 베트남어 등 다양한 언어를 지원합니다. Tesseract에 해당 언어 팩이 설치되어 있는지 확인하십시오. 다음 예제에서는 lang 옵션을 프랑스어인 'fra'로 설정했습니다. Tesseract가 지원하는 모든 언어 코드를 사용할 수 있습니다.

Ruby 라이브러리를 사용하여 다른 언어로 이미지에서 텍스트로 변환하는 방법은?

image = RTesseract.new('path/to/image.png', lang: 'fra') # French language
text = image.to_s

puts text
 한국인