Nemokamas Node.js API OCR galimybių pridėjimui prie JS projektų.
Atviro kodo Node.js OCR biblioteka, leidžianti programuotojams atpažinti ir ištraukti tekstą iš įvairių failų formatų, įskaitant vaizdus (JPEG, PNG), PDF ir dokumentus, nemokamai keliomis kalbomis.
Kas yra Node-Tesseract-OCR?
Šiandienos skaitmeniniame amžiuje teksto išgavimas iš vaizdų ir dokumentų tapo svarbia užduotimi įvairiose pramonės šakose, įskaitant dokumentų valdymą, duomenų apdorojimą ir dirbtinį intelektą. Optinio ženklų atpažinimo (OCR) technologija leido konvertuoti nuskenuotus dokumentus, vaizdus ir PDF į redaguojamus teksto formatus. Node-Tesseract-OCR yra atviro kodo API, kuris integruoja Tesseract OCR variklio galią, suteikdamas sklandų ir efektyvų būdą atlikti OCR užduotis Node.js programose.
Node-Tesseract-OCR yra Node.js apvalkalas Tesseract OCR varikliui, leidžiantis programinės įrangos kūrėjams naudoti Tesseract galingas teksto atpažinimo funkcijas Node.js aplinkoje. API yra prižiūrima šioje GitHub saugykloje ir siūlo įvairias funkcijas, kurios ją padaro tinkamą įvairioms naudojimo atvejams, nuo paprasto teksto išgavimo iki sudėtingesnių dokumentų apdorojimo užduočių. Programinės įrangos kūrėjai gali išgauti tekstą iš vaizdų ir dokumentų keliomis kalbomis, todėl tai yra universalus įrankis įvairioms programoms.
Node-Tesseract-OCR API suteikia pažangias vaizdo apdorojimo galimybes, įskaitant vaizdo filtravimą, dydžio keitimą ir apkirpimą, siekiant užtikrinti, kad išgautas tekstas būtų tikslus ir patikimas. Ji palaiko daugiau nei 100 kalbų, todėl yra universalus sprendimas OCR užduotims įvairiose aplinkose. Programinės įrangos kūrėjai gali išgauti tekstą iš vaizdų, PDF ir dokumentų bei grąžinti išgautą tekstą įvairiais formatais, tokiais kaip JSON, XML ir paprastas tekstas. Ji sukurta būti lengva, lanksti ir paprasta naudoti, todėl yra idealus pasirinkimas kūrėjams, norintiems savo projektams pridėti OCR galimybes. Su savo pažangiomis vaizdo apdorojimo galimybėmis, kalbų palaikymu ir klaidų tvarkymo mechanizmais, ji yra idealus pasirinkimas kūrėjams, norintiems savo projektams pridėti OCR galimybes.
Pradžia su Node-Tesseract-OCR
Rekomenduojamas būdas įdiegti Node-Tesseract-OCR yra naudojant npm. Prašome naudoti šią komandą sklandžiam įdiegimui
Įdiekite Node-Tesseract-OCR per npm
npm install node-tesseract-ocr Taip pat galite įdiegti tai rankiniu būdu; atsisiųskite naujausius leidimo failus tiesiai iš GitHub repozytorijos.
Teksto išgavimas iš vaizdų Node.js API
Atviro kodo Node-Tesseract-OCR biblioteka leidžia programinės įrangos kūrėjams lengvai kurti programas, kurios automatiškai išgauna tekstą iš vaizdų Node.js programose. Ji palaiko teksto išgavimą iš nuskenuotų dokumentų, PDF failų, fotoaparatų nuotraukų arba kvitų nuotraukų. Tai gali būti naudinga kuriant peržiūrimus archyvus, automatizuojant duomenų įvedimą arba apdorojant didelius dokumentų kiekius sektoriuose, tokiuose kaip finansai ir sveikatos priežiūra. Štai paprastas pavyzdys, kuris rodo, kaip programiškai išgauti tekstą iš vaizdų Node.js programose.
Kaip išgauti tekstą iš vaizdų Node.js aplinkoje?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Geresnis vaizdų išankstinis apdorojimas Node.js viduje
Vaizdų išankstinis apdorojimas prieš taikant OCR gali žymiai pagerinti teksto atpažinimo tikslumą. Atviro kodo Node-Tesseract-OCR biblioteka leidžia naudoti pagrindines išankstinio apdorojimo technikas, tokias kaip dydžio keitimas, binarizavimas ir iškreipimo koregavimas. Šiuos išankstinio apdorojimo žingsnius galima įgyvendinti naudojant papildomas Node.js bibliotekas, pvz., sharp arba jimp, kartu su Node-Tesseract-OCR. Žemiau pateiktas pavyzdys rodo, kaip programinės įrangos kūrėjai naudoja išankstinio apdorojimo žingsnius, kad pagerintų atpažinimą, ypač su žemesnės kokybės vaizdais.
Kaip taikyti išankstinio apdorojimo žingsnius, kad pagerintumėte atpažinimą per Node.js API?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Atpažintas tekstas keliomis kalbomis
Viena iš išskirtinių Node-Tesseract-OCR savybių yra plačiai išplėtota daugiakalbė parama. Tesseract OCR biblioteka palaiko daugiau nei 100 kalbų, todėl ji yra idealus pasirinkimas programoms, kurioms reikia apdoroti dokumentus įvairiomis kalbomis. Programinės įrangos kūrėjai gali nurodyti kalbą(-as), kurias nori, kad Tesseract naudotų, taip pagerindami atpažinimo tikslumą neanglų kalbos tekstams. Štai pavyzdys, kuris rodo, kaip programinės įrangos kūrėjai gali atpažinti tekstą prancūzų kalba Node.js programose?
Kaip atpažinti tekstą iš vaizdo prancūzų kalba per JavaScript API?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});