1. Termékek
  2.   OCR
  3.   JavaScript
  4.   Guten OCR
 
  

Ingyenes JavaScript könyvtár a beolvasott képekből és űrlapokból szöveg kinyeréséhez

Nyílt forráskódú optikai karakterfelismerő (OCR) JavaScript könyvtár szöveg kinyeréséhez fekete-fehér beolvasott képekből és dokumentumokból képelőfeldolgozással és sablonok támogatásával webes vagy Node.js alkalmazásokban.

A modern digitális világban az optikai karakterfelismerés (OCR) technológia kritikus szerepet játszik a beolvasott képek, kézírásos jegyzetek vagy nyomtatott dokumentumok szerkeszthető és kereshető adatokká alakításában. Azoknak a JavaScript fejlesztőknek, akik könnyű és nyílt forráskódú megoldást keresnek, a Guten OCR vonzó választás. Ez a JavaScript-alapú OCR motor egyszerűségre épül, így ideális az OCR funkciók közvetlen beágyazásához böngésző-alapú vagy Node.js alkalmazásokba. A könyvtár több fontos funkciót is tartalmaz, például karakterfelismerés sablonok alapján, képszintű küszöbölés és binarizálás, karakter szegmentálás, sablonillesztés és szövegösszeállítás, moduláris kódbázis támogatás stb. Elsősorban a fekete-fehér beolvasott dokumentumok nyomtatott szövegének felismerésére fókuszál, és leginkább jól formázott szövegekre, például könyvekre vagy űrlapokra alkalmas.

A Guten OCR egy nyílt forráskódú JavaScript OCR motor, amelyet a Gutenye hozott létre. A nehéz OCR eszközökkel, amelyek külső függőségeket vagy kiterjedt beállítást igényelnek, ellentétben, a Guten OCR teljesen JavaScript-ben íródott, ami azt jelenti, hogy futtatható web böngészőben vagy a Node.js szerveren. A könyvtár alapvető képfeldolgozási technikákat használ a karakterek szegmentálásához és azok azonosításához egy karaktermintázat-azonosító rendszerrel. Bár még nem versenyez a kereskedelmi OCR motorokkal, mint a Tesseract, a többnyelvű vagy kézírásos szöveg támogatásában, egyszerűsége és hackelhetősége fantasztikus lehetőséget kínál oktatási projektekhez, koncepciók bizonyításához vagy beágyazott OCR funkciókhoz egyedi webalkalmazásokban. A Tesseracttól vagy más nagyobb motoroktól eltérően a Guten OCR szándékosan könnyű és fókuszált – így kiváló kiindulópont azok számára, akik meg akarják érteni, hogyan működik az OCR a háttérben.

Previous Next

Első lépések a Guten OCR használatához

A Guten OCR telepítésének ajánlott módja a Brew használata. Kérjük, használja a következő parancsot a zökkenőmentes telepítéshez.

Telepítsd a Guten OCR-t a Brew segítségével

 brew install git-lfs 

Telepítse a Guten OCR-t a GitHubon keresztül

 git clone git@github.com:gutenye/ocr.git 

Telepítheti manuálisan is; a legújabb kiadási fájlokat közvetlenül a GitHub tárolóból töltheti le.

Képelőfeldolgozás OCR műveletek előtt

Az nyílt forráskódú Guten OCR könyvtár teljesen JavaScript-ben íródott, így kompatibilis mind a böngésző, mind a Node.js környezetekkel. Beépített képelőfeldolgozó funkciókat tartalmaz a felismerési pontosság javításához. Támogatja a képek binarizálását (fekete-fehér konvertálás), zajcsökkentést, dőléskorrekciót és még sok mást. Az alábbi példa bemutatja, hogyan alkalmazhatnak a fejlesztők több képelőfeldolgozási lépést, mielőtt OCR műveletet végeznének a képeken.

Hogyan alkalmazzon képelőfeldolgozást az OCR művelet előtt JavaScript könyvtár segítségével?

const { preprocess } = require('guten-ocr');

// Apply multiple preprocessing steps
const processedImage = preprocess(imageData, [
  'grayscale',    // Convert to grayscale
  'binarize',     // Convert to black and white
  'deskew',       // Correct skew
  'denoise'       // Reduce noise
]);

// Then perform OCR on the processed image
ocr.recognize(processedImage).then(/* ... */);

Karakterfelismerés sablonok segítségével

A JavaScript könyvtár, a Guten OCR teljes támogatást nyújt az OCR műveletek sablonok használatával történő végrehajtásához JavaScript alkalmazásokban. A Guten OCR középpontjában egy sablon-összehasonlító rendszer áll. A gépi tanulási modell betanítása helyett előre meghatározott karaktermintákat használ. Ez gyorsabbá és könnyebben érthetővé teszi a rendszert, de érzékenyebb a betűtípus- és elrendezéskonzisztenciára. A feladat elvégzéséhez a könyvtár minden karaktert (A–Z, a–z, 0–9, stb.) egy canvas-on renderel, majd az egyes karakterek bináris mátrixa referencia sablonná válik. Kép elemzésekor a könyvtár a képrészleteket összehasonlítja ezekkel a sablonokkal, hogy megtalálja a legjobb egyezést. Ezt függőleges és vízszintes vonalvizsgálat kombinációjával végzi a határoló dobozok megtalálásához.

Karakter szegmentálás OCR könyvtár segítségével

A nyílt forráskódú JavaScript könyvtár, a Guten OCR lehetővé teszi a szoftverfejlesztők számára, hogy könnyedén karakter szegmentálást végezzenek. Miután a kép binarizálva van, a következő lépés az egyes karakterek szegmentálása. A Guten OCR sorokat és oszlopokat vizsgál, hogy sűrű fekete pixeleket tartalmazó területeket észleljen, és ezeket potenciális karakterekké válassza szét. Az alábbi példa bemutatja, hogyan végezhetnek a szoftverfejlesztők karakter szegmentálást a JavaScript OCR könyvtár használatával.

Hogyan hajtson végre karakter szegmentálást JavaScript könyvtár használatával?

const segment = require('guten-ocr/segment');
const boxes = segment(binarized); // returns array of [x, y, width, height]
 Magyar