1. Termékek
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

Ingyenes Node.js API OCR képességek hozzáadásához JS projektekhez.

Nyílt forráskódú Node.js OCR könyvtár, amely lehetővé teszi a programozók számára, hogy ingyenesen felismerjék és kinyerjék a szöveget különféle fájlformátumokból, beleértve a képeket (JPEG, PNG), PDF-eket és dokumentumokat több nyelven.

Mi az a Node-Tesseract-OCR?

A mai digitális korszakban a képekből és dokumentumokból történő szövegkinyerés kulcsfontosságú feladattá vált számos iparágban, beleértve a dokumentumkezelést, az adatfeldolgozást és a mesterséges intelligenciát. Az optikai karakterfelismerés (OCR) technológia lehetővé tette a beolvasott dokumentumok, képek és PDF-ek szerkeszthető szövegformátumokká alakítását. A Node-Tesseract-OCR egy nyílt forráskódú API, amely a Tesseract OCR motor erejét felhasználva zökkenőmentes és hatékony módot biztosít az OCR feladatok végrehajtásához Node.js alkalmazásokban.

Node-Tesseract-OCR egy Node.js csomag a Tesseract OCR motorhoz, amely lehetővé teszi a szoftverfejlesztők számára, hogy a Tesseract erőteljes szövegfelismerési funkcióit egy Node.js környezetben használják. Az API-t ebben a GitHub tárolóban tartják karban, és számos funkciót kínál, amelyek alkalmassá teszik különböző felhasználási esetekre, az egyszerű szövegkinyeréstől a bonyolultabb dokumentumfeldolgozási feladatokig. A szoftverfejlesztők képesek szöveget kinyerni képekből és dokumentumokból több nyelven, így sokoldalú eszköz különféle alkalmazásokhoz.

A Node-Tesseract-OCR API fejlett képfeldolgozási képességeket biztosít, beleértve a képszűrést, átméretezést és vágást, hogy a kinyert szöveg pontos és megbízható legyen. Több mint 100 nyelvet támogat, ami sokoldalú megoldássá teszi az OCR feladatokhoz különböző környezetekben. A szoftverfejlesztők képesek szöveget kinyerni képekből, PDF-ekből és dokumentumokból, és a kinyert szöveget különféle formátumokban visszaadni, például JSON, XML és egyszerű szöveg formájában. A rendszer könnyű, rugalmas és könnyen használható, így ideális választás azoknak a fejlesztőknek, akik OCR képességeket szeretnének hozzáadni projektjeikhez. Fejlett képfeldolgozási képességei, nyelvtámogatása és hibakezelési mechanizmusai miatt tökéletes választás a fejlesztők számára, akik OCR funkciókat kívánnak integrálni projektjeikbe.

Previous Next

Első lépések a Node-Tesseract-OCR használatával

A Node-Tesseract-OCR telepítésének ajánlott módja az npm használata. Kérjük, használja a következő parancsot a zökkenőmentes telepítéshez.

Telepítsd a Node-Tesseract-OCR-t npm-en keresztül

npm install node-tesseract-ocr 

Telepítheted manuálisan is; töltsd le a legújabb kiadási fájlokat közvetlenül a GitHub tárolóból.

Szövegkinyerés képekből a Node.js API-ban

Az nyílt forráskódú Node-Tesseract-OCR könyvtár megkönnyíti a szoftverfejlesztők számára, hogy olyan alkalmazásokat hozzanak létre, amelyek automatikusan kinyerik a szöveget a képekből a Node.js alkalmazásokon belül. Támogatja a szövegkinyerést beolvasott dokumentumokból, PDF-ekből, kamera fényképekből vagy nyugták képeiből. Ez hasznos lehet kereshető archívumok létrehozásához, az adatbevitel automatizálásához, vagy nagy mennyiségű dokumentum feldolgozásához olyan ágazatokban, mint a pénzügy és az egészségügy. Íme egy egyszerű példa, amely bemutatja, hogyan lehet programozottan kinyerni a szöveget a képekből a Node.js alkalmazásokon belül.

Hogyan lehet szöveget kinyerni képekből a Node.js környezetben?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Jobb képelőfeldolgozás a Node.js-ben

Az OCR alkalmazása előtt a képek előfeldolgozása jelentősen javíthatja a szövegfelismerés pontosságát. A nyílt forráskódú Node-Tesseract-OCR könyvtár lehetővé teszi az alapvető előfeldolgozási technikákat, mint a méretezés, binarizálás és a ferde vonalak korrigálása. Ezeket az előfeldolgozási lépéseket további Node.js könyvtárakkal, például a sharp vagy a jimp segítségével, a Node-Tesseract-OCR-rel együtt lehet megvalósítani. Az alábbi példa bemutatja, hogyan használják a szoftverfejlesztők az előfeldolgozási lépéseket a felismerés javítására, különösen alacsony minőségű képek esetén.

Hogyan alkalmazhatók előfeldolgozási lépések a felismerés javításához a Node.js API-n keresztül?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Felismert szöveg több nyelven

A Node-Tesseract-OCR egyik kiemelkedő tulajdonsága a kiterjedt többnyelvű támogatás. A Tesseract OCR könyvtár több mint 100 nyelvet támogat, ami ideálissá teszi olyan alkalmazások számára, amelyeknek különböző nyelveken írt dokumentumokat kell feldolgozniuk. A szoftverfejlesztők megadhatják, hogy a Tesseract mely nyelvet (vagy nyelveket) használjon, ezáltal javítva a nem angol szövegek felismerési pontosságát. Íme egy példa, amely bemutatja, hogyan tudnak a szoftverfejlesztők francia nyelvű szöveget felismerni a Node.js alkalmazásokban?

Hogyan lehet franciául szöveget felismerni képről a JavaScript API-n keresztül?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 Magyar