JS प्रोजेक्ट्स में OCR क्षमताएँ जोड़ने के लिए नि:शुल्क Node.js API।
ओपन सोर्स Node.js OCR लाइब्रेरी जो प्रोग्रामरों को विभिन्न फ़ाइल फ़ॉर्मैट्स, जैसे छवियों (JPEG, PNG), PDFs, और दस्तावेज़ों से मुफ्त में बहु-भाषाओं में टेक्स्ट पहचानने और निकालने की अनुमति देती है।
Node-Tesseract-OCR क्या है?
आज के डिजिटल युग में, छवियों और दस्तावेज़ों से टेक्स्ट निकालना विभिन्न उद्योगों में, जैसे दस्तावेज़ प्रबंधन, डेटा प्रोसेसिंग और कृत्रिम बुद्धिमत्ता, में एक महत्वपूर्ण कार्य बन गया है। ऑप्टिकल कैरेक्टर रिकग्निशन (OCR) तकनीक ने स्कैन किए गए दस्तावेज़ों, छवियों और PDF को संपादन योग्य टेक्स्ट फ़ॉर्मेट में बदलना संभव बना दिया है। Node-Tesseract-OCR एक ओपन-सोर्स API है जो Tesseract OCR इंजन की शक्ति को सम्मिलित करके Node.js एप्लिकेशनों में OCR कार्यों को सहज और कुशल तरीके से करने का समाधान प्रदान करता है।
Node-Tesseract-OCR एक Node.js रैपर है Tesseract OCR इंजन के लिए, जो सॉफ़्टवेयर डेवलपर्स को Node.js वातावरण में Tesseract की शक्तिशाली टेक्स्ट पहचान सुविधाओं का उपयोग करने की अनुमति देता है। API इस GitHub रिपॉज़िटरी पर रखी गई है और विभिन्न कार्यात्मकताओं की एक श्रृंखला प्रदान करती है जो इसे विभिन्न उपयोग मामलों के लिए उपयुक्त बनाती है, सरल टेक्स्ट निष्कर्षण से लेकर अधिक जटिल दस्तावेज़ प्रोसेसिंग कार्यों तक। सॉफ़्टवेयर डेवलपर्स कई भाषाओं में छवियों और दस्तावेज़ों से टेक्स्ट निकाल सकते हैं, जिससे यह विभिन्न अनुप्रयोगों के लिए एक बहुमुखी उपकरण बन जाता है।
Node-Tesseract-OCR API उन्नत इमेज प्रोसेसिंग क्षमताएँ प्रदान करता है, जिसमें इमेज फ़िल्टरिंग, रिसाइज़िंग और क्रॉपिंग शामिल हैं, ताकि निकाले गए टेक्स्ट की सटीकता और विश्वसनीयता सुनिश्चित हो सके। यह 100 से अधिक भाषाओं का समर्थन करता है, जिससे यह विविध वातावरण में OCR कार्यों के लिए एक बहुमुखी समाधान बन जाता है। सॉफ़्टवेयर डेवलपर्स इमेज, PDF और दस्तावेज़ों से टेक्स्ट निकाल सकते हैं, और निकाले गए टेक्स्ट को विभिन्न फ़ॉर्मैट्स जैसे JSON, XML और साधारण टेक्स्ट में वापस कर सकते हैं। इसे हल्का, लचीला और उपयोग में आसान बनाने के लिए डिज़ाइन किया गया है, जिससे यह उन डेवलपर्स के लिए आदर्श विकल्प है जो अपने प्रोजेक्ट्स में OCR क्षमताएँ जोड़ना चाहते हैं। अपनी उन्नत इमेज प्रोसेसिंग क्षमताओं, भाषा समर्थन और त्रुटि प्रबंधन तंत्र के साथ, यह उन डेवलपर्स के लिए एक आदर्श विकल्प है जो अपने प्रोजेक्ट्स में OCR क्षमताएँ जोड़ना चाहते हैं।
Node-Tesseract-OCR के साथ शुरूआत
Node-Tesseract-OCR को स्थापित करने का अनुशंसित तरीका npm का उपयोग करना है। सुगम स्थापना के लिए कृपया निम्नलिखित कमांड का उपयोग करें।
npm के माध्यम से Node-Tesseract-OCR स्थापित करें
npm install node-tesseract-ocr आप इसे मैन्युअल रूप से भी स्थापित कर सकते हैं; नवीनतम रिलीज़ फ़ाइलें सीधे GitHub रिपॉजिटरी से डाउनलोड करें।
Node.js API में छवियों से पाठ निकालना
ओपन सोर्स Node-Tesseract-OCR लाइब्रेरी सॉफ़्टवेयर डेवलपर्स के लिए Node.js एप्लिकेशन के भीतर छवियों से स्वचालित रूप से टेक्स्ट निकालने वाले एप्लिकेशन बनाना आसान बनाती है। यह स्कैन किए गए दस्तावेज़ों, PDFs, कैमरा फ़ोटो या रसीदों की फ़ोटो से टेक्स्ट निष्कर्षण का समर्थन करती है। यह खोज योग्य अभिलेख बनाना, डेटा एंट्री को स्वचालित करना, या वित्त और स्वास्थ्य देखभाल जैसे क्षेत्रों में बड़ी मात्रा में दस्तावेज़ों को प्रोसेस करने में उपयोगी हो सकता है। यहाँ एक सरल उदाहरण है जो दिखाता है कि Node.js एप्लिकेशन के भीतर छवियों से प्रोग्रामेटिक रूप से टेक्स्ट कैसे निकाला जाए।
Node.js पर्यावरण में छवियों से टेक्स्ट कैसे निकालें?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Node.js के भीतर बेहतर छवि पूर्व-प्रसंस्करण
OCR लागू करने से पहले छवियों की पूर्व-प्रसंस्करण करने से टेक्स्ट पहचान की सटीकता में उल्लेखनीय सुधार हो सकता है। ओपन सोर्स Node-Tesseract-OCR लाइब्रेरी बुनियादी पूर्व-प्रसंस्करण तकनीकों जैसे आकार बदलना, बाइनरीकरण, और डेस्क्यूइंग की अनुमति देती है। ये पूर्व-प्रसंस्करण चरण अतिरिक्त Node.js लाइब्रेरी जैसे sharp या jimp के साथ Node-Tesseract-OCR के संयोजन में लागू किए जा सकते हैं। निम्नलिखित उदाहरण दिखाता है कि सॉफ़्टवेयर डेवलपर्स कैसे पूर्व-प्रसंस्करण चरणों का उपयोग करके पहचान में सुधार करते हैं, विशेष रूप से कम गुणवत्ता वाली छवियों के साथ।
Node.js API के माध्यम से पहचान में सुधार के लिए प्रीप्रोसेसिंग चरण कैसे लागू करें?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
बहु-भाषाओं में पहचाना गया पाठ
Node-Tesseract-OCR की प्रमुख विशेषताओं में से एक इसका व्यापक बहु-भाषा समर्थन है। Tesseract OCR लाइब्रेरी 100 से अधिक भाषाओं का समर्थन करती है, जिससे यह उन अनुप्रयोगों के लिए आदर्श विकल्प बन जाता है जिन्हें विभिन्न भाषाओं में दस्तावेज़ों को प्रोसेस करना होता है। सॉफ़्टवेयर डेवलपर्स वह भाषा(भाषाएँ) निर्दिष्ट कर सकते हैं जिन्हें वे Tesseract से उपयोग करवाना चाहते हैं, जिससे गैर-अंग्रेज़ी पाठों की पहचान की सटीकता बढ़ती है। यहाँ एक उदाहरण है जो दिखाता है कि सॉफ़्टवेयर डेवलपर्स Node.js अनुप्रयोगों के भीतर फ्रेंच में टेक्स्ट को कैसे पहचान सकते हैं?
JavaScript API के माध्यम से फ्रेंच में छवि से टेक्स्ट कैसे पहचाना जाए?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});