Ilmainen Node.js API OCR-ominaisuuksien lisäämiseksi JS-projekteihin.
Avoimen lähdekoodin Node.js OCR -kirjasto, joka mahdollistaa ohjelmoijille tekstin tunnistamisen ja poimimisen eri tiedostomuodoista, mukaan lukien kuvat (JPEG, PNG), PDF:t ja asiakirjat, ilmaiseksi monilla kielillä.
Mikä on Node-Tesseract-OCR?
Nykyisessä digitaalisessa aikakaudessa tekstin poimiminen kuvista ja asiakirjoista on tullut keskeiseksi tehtäväksi eri toimialoilla, kuten asiakirjojen hallinnassa, tietojenkäsittelyssä ja tekoälyssä. Optinen merkkien tunnistus (OCR) -teknologia on mahdollistanut skannattujen asiakirjojen, kuvien ja PDF-tiedostojen muuntamisen muokattaviksi tekstimuodoiksi. Node-Tesseract-OCR on avoimen lähdekoodin API, joka yhdistää Tesseract OCR -moottorin voiman tarjotakseen saumattoman ja tehokkaan tavan suorittaa OCR-tehtäviä Node.js-sovelluksissa.
Node-Tesseract-OCR on Node.js-kääre Tesseract OCR -moottorille, jonka avulla ohjelmistokehittäjät voivat hyödyntää Tesseractin tehokkaita tekstintunnistusominaisuuksia Node.js-ympäristössä. APIa ylläpidetään tässä GitHub-repositoriossa, ja se tarjoaa joukon toiminnallisuuksia, jotka tekevät siitä sopivan erilaisiin käyttötapauksiin, yksinkertaisesta tekstin poiminnasta monimutkaisempiin asiakirjankäsittelytehtäviin. Ohjelmistokehittäjät voivat poimia tekstiä kuvista ja asiakirjoista useilla kielillä, mikä tekee siitä monipuolisen työkalun erilaisiin sovelluksiin.
Node-Tesseract-OCR API tarjoaa kehittyneitä kuvankäsittelyominaisuuksia, mukaan lukien kuvan suodatus, koon muuttaminen ja rajaus, varmistaakseen että poimittu teksti on tarkkaa ja luotettavaa. Se tukee yli 100 kieltä, mikä tekee siitä monipuolisen ratkaisun OCR-tehtäviin erilaisissa ympäristöissä. Ohjelmistokehittäjät voivat poimia tekstiä kuvista, PDF-tiedostoista ja asiakirjoista, ja palauttaa poimitun tekstin erilaisissa formaateissa, kuten JSON, XML ja tavallinen teksti. Se on suunniteltu kevyeksi, joustavaksi ja helppokäyttöiseksi, mikä tekee siitä ihanteellisen valinnan kehittäjille, jotka haluavat lisätä OCR-ominaisuuksia projekteihinsa. Kehittyneiden kuvankäsittelyominaisuuksien, kielituen ja virheenkäsittelymekanismien ansiosta se on ihanteellinen valinta kehittäjille, jotka haluavat lisätä OCR-ominaisuuksia projekteihinsa.
Aloittaminen Node-Tesseract-OCR:n kanssa
Suositeltu tapa asentaa Node-Tesseract-OCR on käyttää npm:ää. Käytä seuraavaa komentoa sujuvan asennuksen varmistamiseksi
Asenna Node-Tesseract-OCR npm:n kautta
npm install node-tesseract-ocr Voit myös asentaa sen manuaalisesti; lataa uusimmat julkaisutiedostot suoraan GitHub-varastosta.
Tekstin poiminta kuvista Node.js API:ssa
Avoimen lähdekoodin Node-Tesseract-OCR-kirjasto tekee ohjelmistokehittäjille helppoa luoda sovelluksia, jotka automaattisesti poimivat tekstiä kuvista Node.js-sovellusten sisällä. Se tukee tekstin poimintaa skannatuista asiakirjoista, PDF-tiedostoista, kamerakuvista tai kuiteiden valokuvista. Tämä voi olla hyödyllistä hakukelpoisten arkistojen luomisessa, tietojen syöttämisen automatisoinnissa tai suurten asiakirjamäärien käsittelyssä sektoreilla kuten rahoitus ja terveydenhuolto. Tässä on yksinkertainen esimerkki, joka näyttää, miten tekstiä voidaan ohjelmallisesti poimia kuvista Node.js-sovelluksissa.
Kuinka poimia tekstiä kuvista Node.js-ympäristössä?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Parempi kuvankäsittely Node.js:ssä
Kuvien esikäsittely ennen OCR:n soveltamista voi merkittävästi parantaa tekstintunnistuksen tarkkuutta. Avoimen lähdekoodin Node-Tesseract-OCR -kirjasto mahdollistaa perus-esikäsittelytekniikat, kuten koon muuttamisen, binarisoinnin ja vinouden korjaamisen. Näitä esikäsittelyvaiheita voidaan toteuttaa käyttämällä lisä Node.js -kirjastoja, kuten sharp tai jimp, yhdessä Node-Tesseract-OCR:n kanssa. Seuraava esimerkki näyttää, miten ohjelmistokehittäjät käyttävät esikäsittelyvaiheita parantaakseen tunnistusta, erityisesti heikkolaatuisissa kuvissa.
Kuinka soveltaa esikäsittelyvaiheita tunnistuksen parantamiseksi Node.js API:n avulla?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Tunnistettu teksti monilla kielillä
Yksi Node-Tesseract-OCR:n merkittävimmistä ominaisuuksista on sen laaja monikielinen tuki. Tesseract OCR -kirjasto tukee yli 100 kieltä, mikä tekee siitä ihanteellisen valinnan sovelluksille, jotka tarvitsevat asiakirjojen käsittelyä eri kielillä. Ohjelmistokehittäjät voivat määrittää kielen/kielet, joita Tesseract käyttää, parantaen tunnistuksen tarkkuutta ei-englanninkielisissä teksteissä. Tässä on esimerkki, joka näyttää, miten ohjelmistokehittäjät voivat tunnistaa ranskankielistä tekstiä Node.js-sovelluksissa?
Kuinka tunnistaa teksti kuvasta ranskaksi JavaScript API:n avulla?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});