Δωρεάν Node.js API για την προσθήκη δυνατοτήτων OCR σε έργα JS.
Ανοιχτού κώδικα βιβλιοθήκη Node.js OCR που επιτρέπει στους προγραμματιστές να αναγνωρίζουν & να εξάγουν κείμενο από διάφορες μορφές αρχείων, συμπεριλαμβανομένων εικόνων (JPEG, PNG), PDF και εγγράφων δωρεάν σε πολλές γλώσσες.
Τι είναι το Node-Tesseract-OCR;
Στη σύγχρονη ψηφιακή εποχή, η εξαγωγή κειμένου από εικόνες και έγγραφα έχει γίνει ένα κρίσιμο έργο σε διάφορους κλάδους, συμπεριλαμβανομένης της διαχείρισης εγγράφων, της επεξεργασίας δεδομένων και της τεχνητής νοημοσύνης. Η τεχνολογία Οπτικής Αναγνώρισης Χαρακτήρων (OCR) έχει καταστήσει δυνατή τη μετατροπή σαρωμένων εγγράφων, εικόνων και PDF σε επεξεργάσιμα μορφότυπα κειμένου. Το Node-Tesseract-OCR είναι ένα ανοιχτού κώδικα API που ενσωματώνει τη δύναμη της μηχανής Tesseract OCR για να παρέχει έναν απρόσκοπτο και αποδοτικό τρόπο εκτέλεσης εργασιών OCR σε εφαρμογές Node.js.
Node-Tesseract-OCR είναι ένα wrapper για το Node.js για τη μηχανή OCR Tesseract, επιτρέποντας στους προγραμματιστές λογισμικού να αξιοποιούν τις ισχυρές δυνατότητες αναγνώρισης κειμένου του Tesseract σε περιβάλλον Node.js. Το API συντηρείται σε αυτό το αποθετήριο GitHub και προσφέρει μια σειρά λειτουργιών που το καθιστούν κατάλληλο για διάφορες περιπτώσεις χρήσης, από απλή εξαγωγή κειμένου έως πιο σύνθετες εργασίες επεξεργασίας εγγράφων. Οι προγραμματιστές λογισμικού μπορούν να εξάγουν κείμενο από εικόνες και έγγραφα σε πολλές γλώσσες, καθιστώντας το ένα ευέλικτο εργαλείο για διάφορες εφαρμογές.
Το API Node-Tesseract-OCR παρέχει προηγμένες δυνατότητες επεξεργασίας εικόνας, συμπεριλαμβανομένου του φιλτραρίσματος εικόνας, της αλλαγής μεγέθους και της περικοπής, ώστε να εξασφαλιστεί ότι το εξαγόμενο κείμενο είναι ακριβές και αξιόπιστο. Υποστηρίζει πάνω από 100 γλώσσες, καθιστώντας το μια ευέλικτη λύση για εργασίες OCR σε διαφορετικά περιβάλλοντα. Οι προγραμματιστές λογισμικού μπορούν να εξάγουν κείμενο από εικόνες, PDF και έγγραφα, και να επιστρέφουν το εξαγόμενο κείμενο σε διάφορες μορφές, όπως JSON, XML και απλό κείμενο. Σχεδιάστηκε ώστε να είναι ελαφρύ, ευέλικτο και εύκολο στη χρήση, καθιστώντας το ιδανική επιλογή για προγραμματιστές που θέλουν να προσθέσουν δυνατότητες OCR στα έργα τους. Με τις προηγμένες δυνατότητες επεξεργασίας εικόνας, την υποστήριξη γλωσσών και τους μηχανισμούς διαχείρισης σφαλμάτων, αποτελεί ιδανική επιλογή για προγραμματιστές που θέλουν να προσθέσουν δυνατότητες OCR στα έργα τους.
Ξεκινώντας με το Node-Tesseract-OCR
Ο προτεινόμενος τρόπος εγκατάστασης του Node-Tesseract-OCR είναι μέσω npm. Παρακαλώ χρησιμοποιήστε την παρακάτω εντολή για ομαλή εγκατάσταση.
Εγκαταστήστε το Node-Tesseract-OCR μέσω npm
npm install node-tesseract-ocr Μπορείτε επίσης να το εγκαταστήσετε χειροκίνητα· κατεβάστε τα τελευταία αρχεία έκδοσης απευθείας από το αποθετήριο GitHub.
Εξαγωγή κειμένου από εικόνες στο API του Node.js
Η ανοιχτού κώδικα βιβλιοθήκη Node-Tesseract-OCR καθιστά εύκολο για τους προγραμματιστές λογισμικού να δημιουργούν εφαρμογές που εξάγουν αυτόματα κείμενο από εικόνες μέσα σε εφαρμογές Node.js. Υποστηρίζει την εξαγωγή κειμένου από σαρωμένα έγγραφα, PDF, φωτογραφίες κάμερας ή φωτογραφίες αποδείξεων. Αυτό μπορεί να είναι χρήσιμο για τη δημιουργία αναζητήσιμων αρχείων, την αυτοματοποίηση της εισαγωγής δεδομένων ή την επεξεργασία μεγάλου όγκου εγγράφων σε τομείς όπως τα χρηματοοικονομικά και η υγειονομική περίθαλψη. Ακολουθεί ένα απλό παράδειγμα που δείχνει πώς να εξάγετε προγραμματιστικά κείμενο από εικόνες μέσα σε εφαρμογές Node.js.
Πώς να εξάγετε κείμενο από εικόνες σε περιβάλλον Node.js;
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Καλύτερη προεπεξεργασία εικόνων στο Node.js
Η προεπεξεργασία εικόνων πριν την εφαρμογή OCR μπορεί να βελτιώσει σημαντικά την ακρίβεια της αναγνώρισης κειμένου. Η ανοιχτή βιβλιοθήκη Node‑Tesseract‑OCR επιτρέπει βασικές τεχνικές προεπεξεργασίας, όπως αλλαγή μεγέθους, δυαδικοποίηση και διόρθωση κλίσης. Αυτά τα βήματα προεπεξεργασίας μπορούν να υλοποιηθούν χρησιμοποιώντας πρόσθετες βιβλιοθήκες Node.js όπως το sharp ή το jimp σε συνδυασμό με το Node‑Tesseract‑OCR. Το παρακάτω παράδειγμα δείχνει πώς οι προγραμματιστές λογισμικού χρησιμοποιούν βήματα προεπεξεργασίας για να βελτιώσουν την αναγνώριση, ειδικά με εικόνες χαμηλής ποιότητας.
Πώς να εφαρμόσετε βήματα προεπεξεργασίας για τη βελτίωση της αναγνώρισης μέσω του API Node.js;
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Αναγνωρισμένο κείμενο σε πολλαπλές γλώσσες
Ένα από τα χαρακτηριστικά που ξεχωρίζουν του Node‑Tesseract‑OCR είναι η εκτενής υποστήριξη πολλαπλών γλωσσών. Η βιβλιοθήκη Tesseract OCR υποστηρίζει πάνω από 100 γλώσσες, καθιστώντας την ιδανική επιλογή για εφαρμογές που χρειάζεται να επεξεργαστούν έγγραφα σε διάφορες γλώσσες. Οι προγραμματιστές λογισμικού μπορούν να καθορίσουν τη(ς) γλώσσα(ες) που θέλουν να χρησιμοποιήσει το Tesseract, βελτιώνοντας την ακρίβεια αναγνώρισης για κείμενα μη‑αγγλικά. Εδώ είναι ένα παράδειγμα που δείχνει πώς οι προγραμματιστές λογισμικού μπορούν να αναγνωρίσουν κείμενο στα γαλλικά μέσα σε εφαρμογές Node.js;
Πώς να αναγνωρίσετε κείμενο από εικόνα στα γαλλικά μέσω του JavaScript API;
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});