JS 프로젝트에 OCR 기능을 추가하기 위한 무료 Node.js API.
다양한 파일 형식(이미지(JPEG, PNG), PDF 및 문서)에서 텍스트를 무료로 인식하고 추출할 수 있는 다국어 지원 오픈 소스 Node.js OCR 라이브러리.
Node-Tesseract-OCR란 무엇인가요?
오늘날 디지털 시대에 이미지와 문서에서 텍스트를 추출하는 것은 문서 관리, 데이터 처리, 인공지능 등 다양한 산업에서 중요한 작업이 되었습니다. 광학 문자 인식(OCR) 기술은 스캔한 문서, 이미지 및 PDF를 편집 가능한 텍스트 형식으로 변환할 수 있게 했습니다. Node-Tesseract-OCR은 Tesseract OCR 엔진의 강력을 통합한 오픈소스 API로, Node.js 애플리케이션에서 OCR 작업을 원활하고 효율적으로 수행할 수 있게 합니다.
Node-Tesseract-OCR은 Tesseract OCR 엔진을 위한 Node.js 래퍼로, 소프트웨어 개발자가 Node.js 환경에서 Tesseract의 강력한 텍스트 인식 기능을 활용할 수 있게 합니다. 이 API는 해당 GitHub 저장소에서 관리되며, 간단한 텍스트 추출부터 보다 복잡한 문서 처리 작업에 이르기까지 다양한 사용 사례에 적합한 기능들을 제공합니다. 소프트웨어 개발자는 이미지와 문서에서 여러 언어의 텍스트를 추출할 수 있어 다양한 애플리케이션에 활용 가능한 다목적 도구입니다.
Node-Tesseract-OCR API는 이미지 필터링, 리사이징, 크롭 등 고급 이미지 처리 기능을 제공하여 추출된 텍스트의 정확성과 신뢰성을 보장합니다. 100개 이상의 언어를 지원하여 다양한 환경에서 OCR 작업을 수행할 수 있는 다목적 솔루션입니다. 소프트웨어 개발자는 이미지, PDF 및 문서에서 텍스트를 추출하고 JSON, XML, 일반 텍스트와 같은 다양한 형식으로 반환할 수 있습니다. 가볍고 유연하며 사용이 쉬워 OCR 기능을 프로젝트에 추가하려는 개발자에게 이상적인 선택입니다. 고급 이미지 처리 기능, 언어 지원 및 오류 처리 메커니즘을 갖춘 이 도구는 OCR 기능을 프로젝트에 추가하려는 개발자에게 최적의 선택입니다.
Node-Tesseract-OCR 시작하기
Node-Tesseract-OCR를 설치하는 권장 방법은 npm을 사용하는 것입니다. 원활한 설치를 위해 다음 명령을 사용하십시오.
npm을 통해 Node-Tesseract-OCR 설치
npm install node-tesseract-ocr 수동으로 설치할 수도 있습니다; 최신 릴리스 파일을 GitHub 저장소에서 직접 다운로드하세요.
Node.js API에서 이미지 텍스트 추출
오픈 소스 Node-Tesseract-OCR 라이브러리는 소프트웨어 개발자가 Node.js 애플리케이션 내에서 이미지에서 텍스트를 자동으로 추출하는 애플리케이션을 쉽게 만들 수 있게 해줍니다. 이 라이브러리는 스캔한 문서, PDF, 카메라 사진 또는 영수증 사진에서 텍스트 추출을 지원합니다. 이는 검색 가능한 아카이브를 만들거나, 데이터 입력을 자동화하거나, 금융 및 의료와 같은 분야에서 대량의 문서를 처리하는 데 유용할 수 있습니다. 아래는 Node.js 애플리케이션 내에서 이미지에서 텍스트를 프로그래밍 방식으로 추출하는 간단한 예제입니다.
Node.js 환경에서 이미지에서 텍스트를 추출하는 방법?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Node.js 내부에서 더 나은 이미지 전처리
OCR을 적용하기 전에 이미지를 전처리하면 텍스트 인식 정확도를 크게 향상시킬 수 있습니다. 오픈 소스 Node-Tesseract-OCR 라이브러리는 크기 조정, 이진화, 기울기 보정과 같은 기본 전처리 기술을 지원합니다. 이러한 전처리 단계는 sharp 또는 jimp와 같은 추가 Node.js 라이브러리를 Node-Tesseract-OCR와 함께 사용하여 구현할 수 있습니다. 다음 예시는 소프트웨어 개발자가 특히 저품질 이미지에서 인식을 개선하기 위해 전처리 단계를 어떻게 사용하는지 보여줍니다.
Node.js API를 통해 인식을 개선하기 위한 전처리 단계를 적용하는 방법?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
다중 언어에서 인식된 텍스트
Node-Tesseract-OCR의 눈에 띄는 특징 중 하나는 광범위한 다국어 지원입니다. Tesseract OCR 라이브러리는 100개가 넘는 언어를 지원하여 다양한 언어의 문서를 처리해야 하는 애플리케이션에 이상적인 선택이 됩니다. 소프트웨어 개발자는 Tesseract가 사용할 언어를 지정함으로써 비영어 텍스트에 대한 인식 정확도를 높일 수 있습니다. 다음은 소프트웨어 개발자가 Node.js 애플리케이션 내에서 프랑스어 텍스트를 인식하는 방법을 보여주는 예시입니다?
JavaScript API를 사용하여 프랑스어 이미지에서 텍스트를 인식하는 방법?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});