1. Produse
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

API Node.js gratuit pentru adăugarea funcționalităților OCR în proiecte JS.

Bibliotecă OCR open source pentru Node.js care permite programatorilor să recunoască și să extragă text din diverse formate de fișiere, inclusiv imagini (JPEG, PNG), PDF-uri și documente, gratuit, în mai multe limbi.

Ce este Node-Tesseract-OCR?

În era digitală de astăzi, extragerea textului din imagini și documente a devenit o sarcină crucială în diverse industrii, inclusiv gestionarea documentelor, procesarea datelor și inteligența artificială. Tehnologia de recunoaștere optică a caracterelor (OCR) a făcut posibilă conversia documentelor scanate, imaginilor și PDF-urilor în formate de text editabile. Node-Tesseract-OCR este un API open-source care încorporează puterea motorului Tesseract OCR pentru a oferi o modalitate fluidă și eficientă de a efectua sarcini OCR în aplicații Node.js.

Node-Tesseract-OCR este un wrapper Node.js pentru motorul OCR Tesseract, permițând dezvoltatorilor de software să utilizeze funcțiile puternice de recunoaștere a textului ale Tesseract în mediul Node.js. API-ul este întreținut în acest depozit GitHub și oferă o gamă de funcționalități care îl fac potrivit pentru diverse cazuri de utilizare, de la extragerea simplă a textului până la sarcini mai complexe de procesare a documentelor. Dezvoltatorii de software pot extrage text din imagini și documente în mai multe limbi, făcându-l un instrument versatil pentru diverse aplicații.

API-ul Node-Tesseract-OCR oferă capabilităţi avansate de procesare a imaginilor, inclusiv filtrare, redimensionare şi decupare, pentru a asigura că textul extras este precis şi fiabil. Suportă peste 100 de limbi, fiind o soluţie versatilă pentru sarcini OCR în medii diverse. Dezvoltatorii de software pot extrage text din imagini, PDF‑uri şi documente şi pot returna textul extras în diverse formate, cum ar fi JSON, XML şi text simplu. Este conceput să fie uşor, flexibil şi simplu de utilizat, fiind o alegere ideală pentru dezvoltatorii care doresc să adauge funcţionalităţi OCR proiectelor lor. Cu capabilităţile sale avansate de procesare a imaginilor, suportul lingvistic şi mecanismele de gestionare a erorilor, este o alegere ideală pentru dezvoltatorii care doresc să adauge funcţionalităţi OCR proiectelor lor.

Previous Next

Începerea lucrului cu Node-Tesseract-OCR

Modul recomandat de instalare a Node-Tesseract-OCR este prin npm. Vă rugăm să utilizaţi comanda următoare pentru o instalare fără probleme

Instalați Node-Tesseract-OCR prin npm

npm install node-tesseract-ocr 

De asemenea, îl poţi instala manual; descarcă fişierele ultimei versiuni direct de pe depozitul GitHub.

Extracție de text din imagini în API-ul Node.js

Biblioteca open source Node-Tesseract-OCR facilitează dezvoltatorilor de software crearea de aplicaţii care extrag automat text din imagini în cadrul aplicaţiilor Node.js. Suportă extragerea de text din documente scanate, PDF-uri, fotografii realizate cu camera sau fotografii ale chitanţelor. Acest lucru poate fi util pentru crearea de arhive căutabile, automatizarea introducerii de date sau procesarea unui volum mare de documente în sectoare precum finanţele şi sănătatea. Iată un exemplu simplu care arată cum să extragi text din imagini în mod programatic în cadrul aplicaţiilor Node.js.

Cum să extragi text din imagini în mediul Node.js?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Preprocesare mai bună a imaginilor în Node.js

Preprocesarea imaginilor înainte de a aplica OCR poate îmbunătăți semnificativ acuratețea recunoașterii textului. Biblioteca open source Node-Tesseract-OCR permite tehnici de preprocesare de bază, cum ar fi redimensionarea, binarizarea și corectarea înclinării. Acești pași de preprocesare pot fi implementați utilizând biblioteci suplimentare Node.js precum sharp sau jimp în combinație cu Node-Tesseract-OCR. Exemplul de mai jos arată cum dezvoltatorii de software folosesc pașii de preprocesare pentru a îmbunătăți recunoașterea, în special cu imagini de calitate inferioară.

Cum să aplici pași de preprocesare pentru a îmbunătăți recunoașterea prin API-ul Node.js?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Text recunoscut în mai multe limbi

Una dintre caracteristicile remarcabile ale Node-Tesseract-OCR este suportul său extins pentru mai multe limbi. Biblioteca Tesseract OCR suportă peste 100 de limbi, făcând-o o alegere ideală pentru aplicațiile care trebuie să proceseze documente în diverse limbi. Dezvoltatorii de software pot specifica limba (limbile) pe care doresc să le folosească Tesseract, îmbunătățind acuratețea recunoașterii pentru texte non-engleze. Iată un exemplu care arată cum dezvoltatorii de software pot recunoaște text în franceză în cadrul aplicațiilor Node.js?

Cum să recunoști text din imagine în franceză prin API JavaScript?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 Română