API Node.js gratuita per aggiungere capacità OCR ai progetti JS.
Libreria OCR open source per Node.js che consente ai programmatori di riconoscere ed estrarre testo da vari formati di file, incluse immagini (JPEG, PNG), PDF e documenti, gratuitamente in più lingue.
Che cos'è Node-Tesseract-OCR?
Nell'era digitale odierna, l'estrazione di testo da immagini e documenti è diventata un compito cruciale in vari settori, tra cui la gestione dei documenti, l'elaborazione dei dati e l'intelligenza artificiale. La tecnologia di Riconoscimento Ottico dei Caratteri (OCR) ha reso possibile convertire documenti scansionati, immagini e PDF in formati di testo modificabili. Node-Tesseract-OCR è un'API open‑source che incorpora la potenza del motore Tesseract OCR per fornire un modo fluido ed efficiente di eseguire attività OCR nelle applicazioni Node.js.
Node-Tesseract-OCR è un wrapper per Node.js del motore OCR Tesseract, che consente agli sviluppatori software di utilizzare le potenti funzionalità di riconoscimento del testo di Tesseract all'interno di un ambiente Node.js. L'API è mantenuta in questo repository GitHub e offre una gamma di funzionalità che la rendono adatta a vari casi d'uso, dall'estrazione semplice di testo a compiti più complessi di elaborazione dei documenti. Gli sviluppatori software possono estrarre testo da immagini e documenti in più lingue, rendendola uno strumento versatile per diverse applicazioni.
L'API Node-Tesseract-OCR offre funzionalità avanzate di elaborazione delle immagini, inclusi filtraggio, ridimensionamento e ritaglio, per garantire che il testo estratto sia accurato e affidabile. Supporta oltre 100 lingue, rendendola una soluzione versatile per le attività OCR in ambienti diversi. Gli sviluppatori software possono estrarre testo da immagini, PDF e documenti, e restituire il testo estratto in una varietà di formati, come JSON, XML e testo semplice. È progettata per essere leggera, flessibile e facile da usare, rendendola una scelta ideale per gli sviluppatori che desiderano aggiungere capacità OCR ai loro progetti. Con le sue funzionalità avanzate di elaborazione delle immagini, il supporto linguistico e i meccanismi di gestione degli errori, è una scelta ideale per gli sviluppatori che desiderano aggiungere capacità OCR ai loro progetti.
Guida introduttiva a Node-Tesseract-OCR
Il modo consigliato per installare Node-Tesseract-OCR è utilizzare npm. Si prega di usare il comando seguente per un'installazione senza problemi
Installa Node-Tesseract-OCR via npm
npm install node-tesseract-ocr Puoi anche installarlo manualmente; scarica i file dell'ultima versione direttamente dal repository GitHub.
Estrazione di testo dalle immagini nell'API Node.js
La libreria open source Node-Tesseract-OCR semplifica il lavoro degli sviluppatori software, consentendo di creare applicazioni che estraggono automaticamente il testo dalle immagini all'interno di applicazioni Node.js. Supporta l'estrazione di testo da documenti scannerizzati, PDF, foto scattate con la fotocamera o foto di ricevute. Questo può essere utile per creare archivi ricercabili, automatizzare l'inserimento dei dati o elaborare grandi volumi di documenti in settori come la finanza e l'assistenza sanitaria. Ecco un semplice esempio che mostra come estrarre programmaticamente il testo dalle immagini all'interno di applicazioni Node.js.
Come estrarre testo dalle immagini nell'ambiente Node.js?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Migliore preelaborazione delle immagini in Node.js
Il pre‑processamento delle immagini prima di applicare l'OCR può migliorare significativamente l'accuratezza del riconoscimento del testo. La libreria open source Node‑Tesseract‑OCR consente tecniche di pre‑processamento di base, come ridimensionamento, binarizzazione e correzione dell'inclinazione. Questi passaggi di pre‑processamento possono essere implementati utilizzando librerie aggiuntive per Node.js come sharp o jimp in combinazione con Node‑Tesseract‑OCR. L'esempio seguente mostra come gli sviluppatori software utilizzano i passaggi di pre‑processamento per migliorare il riconoscimento, soprattutto con immagini di qualità inferiore.
Come applicare passaggi di pre‑elaborazione per migliorare il riconoscimento tramite l'API Node.js?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Testo riconosciuto in più lingue
Una delle caratteristiche più distintive di Node‑Tesseract‑OCR è il suo ampio supporto multilingue. La libreria Tesseract OCR supporta più di 100 lingue, rendendola una scelta ideale per le applicazioni che devono elaborare documenti in varie lingue. Gli sviluppatori software possono specificare le lingue che desiderano che Tesseract utilizzi, migliorando l'accuratezza del riconoscimento per testi non inglesi. Ecco un esempio che mostra come gli sviluppatori software possono riconoscere testo in francese all'interno di applicazioni Node.js?
Come riconoscere il testo da un'immagine in francese tramite l'API JavaScript?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});