Ingyenes Node.js API OCR képességek hozzáadásához JS projektekhez.
Nyílt forráskódú Node.js OCR könyvtár, amely lehetővé teszi a programozók számára, hogy ingyenesen felismerjék és kinyerjék a szöveget különféle fájlformátumokból, beleértve a képeket (JPEG, PNG), PDF-eket és dokumentumokat több nyelven.
Mi az a Node-Tesseract-OCR?
A mai digitális korszakban a képekből és dokumentumokból történő szövegkinyerés kulcsfontosságú feladattá vált számos iparágban, beleértve a dokumentumkezelést, az adatfeldolgozást és a mesterséges intelligenciát. Az optikai karakterfelismerés (OCR) technológia lehetővé tette a beolvasott dokumentumok, képek és PDF-ek szerkeszthető szövegformátumokká alakítását. A Node-Tesseract-OCR egy nyílt forráskódú API, amely a Tesseract OCR motor erejét felhasználva zökkenőmentes és hatékony módot biztosít az OCR feladatok végrehajtásához Node.js alkalmazásokban.
Node-Tesseract-OCR egy Node.js csomag a Tesseract OCR motorhoz, amely lehetővé teszi a szoftverfejlesztők számára, hogy a Tesseract erőteljes szövegfelismerési funkcióit egy Node.js környezetben használják. Az API-t ebben a GitHub tárolóban tartják karban, és számos funkciót kínál, amelyek alkalmassá teszik különböző felhasználási esetekre, az egyszerű szövegkinyeréstől a bonyolultabb dokumentumfeldolgozási feladatokig. A szoftverfejlesztők képesek szöveget kinyerni képekből és dokumentumokból több nyelven, így sokoldalú eszköz különféle alkalmazásokhoz.
A Node-Tesseract-OCR API fejlett képfeldolgozási képességeket biztosít, beleértve a képszűrést, átméretezést és vágást, hogy a kinyert szöveg pontos és megbízható legyen. Több mint 100 nyelvet támogat, ami sokoldalú megoldássá teszi az OCR feladatokhoz különböző környezetekben. A szoftverfejlesztők képesek szöveget kinyerni képekből, PDF-ekből és dokumentumokból, és a kinyert szöveget különféle formátumokban visszaadni, például JSON, XML és egyszerű szöveg formájában. A rendszer könnyű, rugalmas és könnyen használható, így ideális választás azoknak a fejlesztőknek, akik OCR képességeket szeretnének hozzáadni projektjeikhez. Fejlett képfeldolgozási képességei, nyelvtámogatása és hibakezelési mechanizmusai miatt tökéletes választás a fejlesztők számára, akik OCR funkciókat kívánnak integrálni projektjeikbe.
Első lépések a Node-Tesseract-OCR használatával
A Node-Tesseract-OCR telepítésének ajánlott módja az npm használata. Kérjük, használja a következő parancsot a zökkenőmentes telepítéshez.
Telepítsd a Node-Tesseract-OCR-t npm-en keresztül
npm install node-tesseract-ocr Telepítheted manuálisan is; töltsd le a legújabb kiadási fájlokat közvetlenül a GitHub tárolóból.
Szövegkinyerés képekből a Node.js API-ban
Az nyílt forráskódú Node-Tesseract-OCR könyvtár megkönnyíti a szoftverfejlesztők számára, hogy olyan alkalmazásokat hozzanak létre, amelyek automatikusan kinyerik a szöveget a képekből a Node.js alkalmazásokon belül. Támogatja a szövegkinyerést beolvasott dokumentumokból, PDF-ekből, kamera fényképekből vagy nyugták képeiből. Ez hasznos lehet kereshető archívumok létrehozásához, az adatbevitel automatizálásához, vagy nagy mennyiségű dokumentum feldolgozásához olyan ágazatokban, mint a pénzügy és az egészségügy. Íme egy egyszerű példa, amely bemutatja, hogyan lehet programozottan kinyerni a szöveget a képekből a Node.js alkalmazásokon belül.
Hogyan lehet szöveget kinyerni képekből a Node.js környezetben?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Jobb képelőfeldolgozás a Node.js-ben
Az OCR alkalmazása előtt a képek előfeldolgozása jelentősen javíthatja a szövegfelismerés pontosságát. A nyílt forráskódú Node-Tesseract-OCR könyvtár lehetővé teszi az alapvető előfeldolgozási technikákat, mint a méretezés, binarizálás és a ferde vonalak korrigálása. Ezeket az előfeldolgozási lépéseket további Node.js könyvtárakkal, például a sharp vagy a jimp segítségével, a Node-Tesseract-OCR-rel együtt lehet megvalósítani. Az alábbi példa bemutatja, hogyan használják a szoftverfejlesztők az előfeldolgozási lépéseket a felismerés javítására, különösen alacsony minőségű képek esetén.
Hogyan alkalmazhatók előfeldolgozási lépések a felismerés javításához a Node.js API-n keresztül?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Felismert szöveg több nyelven
A Node-Tesseract-OCR egyik kiemelkedő tulajdonsága a kiterjedt többnyelvű támogatás. A Tesseract OCR könyvtár több mint 100 nyelvet támogat, ami ideálissá teszi olyan alkalmazások számára, amelyeknek különböző nyelveken írt dokumentumokat kell feldolgozniuk. A szoftverfejlesztők megadhatják, hogy a Tesseract mely nyelvet (vagy nyelveket) használjon, ezáltal javítva a nem angol szövegek felismerési pontosságát. Íme egy példa, amely bemutatja, hogyan tudnak a szoftverfejlesztők francia nyelvű szöveget felismerni a Node.js alkalmazásokban?
Hogyan lehet franciául szöveget felismerni képről a JavaScript API-n keresztül?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});