Gratis Node.js API til at tilføje OCR-funktioner til JS-projekter.
Open Source Node.js OCR-bibliotek, der giver programmører mulighed for at genkende og udtrække tekst fra forskellige filformater, herunder billeder (JPEG, PNG), PDF'er og dokumenter gratis på flere sprog.
Hvad er Node-Tesseract-OCR?
I nutidens digitale tidsalder er udtrækning af tekst fra billeder og dokumenter blevet en afgørende opgave i forskellige industrier, herunder dokumenthåndtering, databehandling og kunstig intelligens. Teknologien for optisk tegngenkendelse (OCR) har gjort det muligt at konvertere scannede dokumenter, billeder og PDF-filer til redigerbare tekstformater. Node-Tesseract-OCR er et open-source API, der integrerer kraften fra Tesseract OCR-motoren for at give en problemfri og effektiv måde at udføre OCR-opgaver i Node.js-applikationer.
Node-Tesseract-OCR er en Node.js-omslag for Tesseract OCR-motoren, som gør det muligt for softwareudviklere at udnytte Tesseratts kraftfulde tekstgenkendelsesfunktioner inden for et Node.js-miljø. API'en vedligeholdes i dette GitHub-repositorium og tilbyder en række funktionaliteter, der gør den egnet til forskellige anvendelsestilfælde, fra simpel tekstudtrækning til mere komplekse dokumentbehandlingsopgaver. Softwareudviklere kan udtrække tekst fra billeder og dokumenter på flere sprog, hvilket gør den til et alsidigt værktøj til forskellige anvendelser.
Node-Tesseract-OCR API'en leverer avancerede billedbehandlingsfunktioner, herunder billedfiltrering, skalering og beskæring, for at sikre at den udtrukne tekst er nøjagtig og pålidelig. Den understøtter over 100 sprog, hvilket gør den til en alsidig løsning til OCR-opgaver i forskellige miljøer. Softwareudviklere kan udtrække tekst fra billeder, PDF'er og dokumenter og returnere den udtrukne tekst i en række formater, såsom JSON, XML og almindelig tekst. Den er designet til at være let, fleksibel og nem at bruge, hvilket gør den til et ideelt valg for udviklere, der ønsker at tilføje OCR-funktionalitet til deres projekter. Med sine avancerede billedbehandlingsfunktioner, sprogunderstøttelse og fejlhåndteringsmekanismer er den et ideelt valg for udviklere, der ønsker at tilføje OCR-funktionalitet til deres projekter.
Kom i gang med Node-Tesseract-OCR
Den anbefalede måde at installere Node-Tesseract-OCR på er ved at bruge npm. Brug venligst følgende kommando for en problemfri installation
Installer Node-Tesseract-OCR via npm
npm install node-tesseract-ocr Du kan også installere det manuelt; download de seneste udgivelsesfiler direkte fra GitHub arkivet.
Tekstudtrækning fra billeder i Node.js API
Det open source Node-Tesseract-OCR-bibliotek gør det nemt for softwareudviklere at skabe applikationer, der automatisk udtrækker tekst fra billeder i Node.js-applikationer. Det understøtter tekstudtrækning fra scannede dokumenter, PDF'er, kamerabilleder eller billeder af kvitteringer. Dette kan være nyttigt til at oprette søgbare arkiver, automatisere dataindtastning eller behandle store mængder dokumenter i sektorer som finans og sundhedspleje. Her er et enkelt eksempel, der viser, hvordan man programmatisk udtrækker tekst fra billeder i Node.js-applikationer.
Hvordan udtrækker man tekst fra billeder i Node.js-miljøet?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Bedre billedforbehandling i Node.js
Forbehandling af billeder før anvendelse af OCR kan betydeligt forbedre nøjagtigheden af tekstgenkendelse. Det open source Node-Tesseract-OCR-bibliotek tillader grundlæggende forbehandlingsteknikker, såsom ændring af størrelse, binarisering og retningkorrektion. Disse forbehandlingsskridt kan implementeres ved brug af yderligere Node.js-biblioteker som sharp eller jimp i kombination med Node-Tesseract-OCR. Det følgende eksempel viser, hvordan softwareudviklere bruger forbehandlingsskridt til at forbedre genkendelsen, især med billeder af lavere kvalitet.
Hvordan anvender man forbehandlingsskridt for at forbedre genkendelse via Node.js API?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Genkendt tekst på flere sprog
En af de mest fremtrædende funktioner ved Node-Tesseract-OCR er dens omfattende understøttelse af flere sprog. Tesseract OCR-biblioteket understøtter over 100 sprog, hvilket gør det til et ideelt valg for applikationer, der skal behandle dokumenter på forskellige sprog. Softwareudviklere kan angive de sprog, de ønsker, at Tesseract skal bruge, hvilket forbedrer genkendelsesnøjagtigheden for ikke-engelske tekster. Her er et eksempel, der viser, hvordan softwareudviklere kan genkende tekst på fransk i Node.js-applikationer?
Hvordan genkender man tekst fra billede på fransk via JavaScript API?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});