1. produkty
  2.   OCR
  3.   JavaScript
  4.   Guten OCR
 
  

Bezplatná JavaScript knihovna pro analýzu textu z naskenovaných obrázků a formulářů

Open source knihovna pro optické rozpoznávání znaků (OCR) v JavaScriptu pro parsování textu z černobílých naskenovaných obrázků a dokumentů s předzpracováním obrazu a podporou šablon ve webových nebo Node.js aplikacích.

V moderním digitálním světě hraje technologie optického rozpoznávání znaků (OCR) klíčovou roli při převodu naskenovaných obrázků, ručně psaných poznámek nebo tištěných dokumentů na editovatelná a prohledávatelná data. Pro vývojáře JavaScriptu, kteří hledají lehké a open-source řešení, nabízí Guten OCR přesvědčivou volbu. Tento na JavaScriptu založený OCR engine je navržen s důrazem na jednoduchost, což ho činí ideálním pro vložení OCR funkcí přímo do prohlížečových nebo Node.js aplikací. Knihovna obsahuje několik důležitých funkcí, jako je rozpoznávání znaků pomocí šablon, prahování a binarizace obrazu, segmentace znaků, porovnávání šablon a sestavování textu, podpora modulárního kódu a další. Soustředí se na rozpoznávání tištěného textu z černobílých naskenovaných dokumentů a nejlépe se hodí pro dobře formátovaný text, jako jsou knihy nebo formuláře.

Guten OCR je open-source OCR engine v JavaScriptu vytvořený společností Gutenye. Na rozdíl od těžkých OCR nástrojů, které vyžadují externí závislosti nebo rozsáhlé nastavení, Guten OCR je napsán zcela v JavaScriptu, což znamená, že může běžet ve webovém prohlížeči nebo na serveru s Node.js. Knihovna používá základní techniky zpracování obrazu k segmentaci znaků a jejich identifikaci pomocí systému rozpoznávání vzorů znaků. I když zatím nemusí konkurovat komerčním OCR engineům jako Tesseract v oblasti podpory více jazyků nebo ručně psaného textu, její jednoduchost a hackovatelnost z ní dělají fantastickou volbu pro vzdělávací projekty, proof-of-concepty nebo vestavěné OCR funkce v vlastních webových aplikacích. Na rozdíl od Tesseractu nebo jiných větších engineů je Guten OCR úmyslně lehký a zaměřený – což z něj dělá vynikající výchozí bod pro ty, kteří chtějí pochopit, jak OCR funguje pod kapotou.

Previous Next

Začínáme s Guten OCR

Doporučený způsob instalace Guten OCR je pomocí Brew. Použijte prosím následující příkaz pro hladkou instalaci

Nainstalujte Guten OCR pomocí Brew

 brew install git-lfs 

Nainstalujte Guten OCR přes GitHub

 git clone git@github.com:gutenye/ocr.git 

Můžete jej také nainstalovat ručně; stáhněte nejnovější soubory vydání přímo z úložiště GitHub.

Předzpracování obrazu před operacemi OCR

Open source knihovna Guten OCR je napsána výhradně v JavaScriptu, což ji činí kompatibilní jak s prohlížečem, tak s prostředím Node.js. Obsahuje vestavěné funkce předzpracování obrazu pro zvýšení přesnosti rozpoznávání. Podporuje binarizaci obrazu (převod na černobílý), redukci šumu, korekci sklonu a další. Následující příklad ukazuje, jak mohou vývojáři aplikovat několik kroků předzpracování obrazu před provedením OCR operace na obrázcích.

Jak použít předzpracování obrazu před operací OCR pomocí JavaScript knihovny?

const { preprocess } = require('guten-ocr');

// Apply multiple preprocessing steps
const processedImage = preprocess(imageData, [
  'grayscale',    // Convert to grayscale
  'binarize',     // Convert to black and white
  'deskew',       // Correct skew
  'denoise'       // Reduce noise
]);

// Then perform OCR on the processed image
ocr.recognize(processedImage).then(/* ... */);

Rozpoznávání znaků pomocí šablon

Knihovna JavaScript Guten OCR poskytuje kompletní podporu pro provádění OCR operací pomocí šablon v JavaScriptových aplikacích. V jádru Guten OCR je systém porovnávání šablon. Místo trénování modelu strojového učení používá předdefinované vzory znaků. To činí systém rychlejším a snáze pochopitelným, ale citlivějším na konzistenci písma a rozvržení. Pro provedení tohoto úkolu knihovna vykresluje každý znak (A–Z, a–z, 0–9, atd.) na plátno a binární matice pro každý znak se stane referenční šablonou. Při analýze obrázku knihovna porovnává segmenty obrázku s těmito šablonami, aby našla nejlepší shodu. Dělá to pomocí kombinace vertikálního a horizontálního skenování řádků k nalezení ohraničujících rámečků.

Segmentace znaků pomocí OCR knihovny

Open source knihovna JavaScript Guten OCR umožňuje vývojářům softwaru snadno provádět segmentaci znaků. Jakmile je obrázek binarizován, dalším krokem je segmentace jednotlivých znaků. Guten OCR skenuje řádky a sloupce, aby detekoval oblasti s hustými černými pixely, a odděluje je do potenciálních znaků. Následující příklad ukazuje, jak vývojáři softwaru mohou provádět segmentaci znaků pomocí JavaScriptové OCR knihovny.

Jak provést segmentaci znaků pomocí JavaScript knihovny?

const segment = require('guten-ocr/segment');
const boxes = segment(binarized); // returns array of [x, y, width, height]
 Čeština