API Node.js ฟรีเพื่อเพิ่มความสามารถ OCR ให้กับโครงการ JS
ไลบรารี OCR แบบโอเพนซอร์สสำหรับ Node.js ที่ช่วยให้นักพัฒนาสามารถจดจำและดึงข้อความจากรูปแบบไฟล์ต่าง ๆ รวมถึงรูปภาพ (JPEG, PNG), PDF, และเอกสารได้ฟรีในหลายภาษา
Node-Tesseract-OCR คืออะไร?
ในยุคดิจิทัลปัจจุบัน การดึงข้อความจากรูปภาพและเอกสารได้กลายเป็นงานที่สำคัญในหลายอุตสาหกรรม รวมถึงการจัดการเอกสาร การประมวลผลข้อมูล และปัญญาประดิษฐ์ เทคโนโลยีการจดจำอักขระด้วยแสง (OCR) ทำให้สามารถแปลงเอกสารสแกน รูปภาพ และไฟล์ PDF ให้เป็นรูปแบบข้อความที่แก้ไขได้ Node-Tesseract-OCR เป็น API แบบโอเพนซอร์สที่รวมพลังของเอนจิน Tesseract OCR เพื่อให้วิธีการทำงาน OCR ในแอปพลิเคชัน Node.js อย่างราบรื่นและมีประสิทธิภาพ
Node-Tesseract-OCR เป็น wrapper ของ Node.js สำหรับเครื่องมือ OCR Tesseract ที่ช่วยให้นักพัฒนาซอฟต์แวร์สามารถใช้คุณสมบัติการจดจำข้อความที่มีประสิทธิภาพของ Tesseract ภายในสภาพแวดล้อม Node.js API ถูกดูแลรักษาในที่เก็บ GitHub นี้และให้ฟังก์ชันการทำงานหลากหลายที่ทำให้เหมาะกับการใช้งานต่าง ๆ ตั้งแต่การสกัดข้อความอย่างง่ายจนถึงงานประมวลผลเอกสารที่ซับซ้อนมากขึ้น นักพัฒนาซอฟต์แวร์สามารถสกัดข้อความจากภาพและเอกสารในหลายภาษา ทำให้เป็นเครื่องมือที่หลากหลายสำหรับการใช้งานต่าง ๆ
API Node-Tesseract-OCR ให้ความสามารถในการประมวลผลภาพขั้นสูง รวมถึงการกรองภาพ การปรับขนาด และการตัดภาพ เพื่อให้ข้อความที่สกัดออกมามีความแม่นยำและเชื่อถือได้ รองรับภาษากว่า 100 ภาษา ทำให้เป็นโซลูชันที่หลากหลายสำหรับงาน OCR ในสภาพแวดล้อมที่หลากหลาย นักพัฒนาซอฟต์แวร์สามารถสกัดข้อความจากภาพ, PDF, และเอกสารต่าง ๆ และส่งคืนข้อความที่สกัดในรูปแบบต่าง ๆ เช่น JSON, XML, และข้อความธรรมดา ถูกออกแบบให้มีน้ำหนักเบา ยืดหยุ่น และใช้งานง่าย ทำให้เป็นตัวเลือกที่เหมาะสำหรับนักพัฒนาที่ต้องการเพิ่มความสามารถ OCR ให้กับโครงการของตน ด้วยความสามารถในการประมวลผลภาพขั้นสูง การสนับสนุนภาษา และกลไกการจัดการข้อผิดพลาด ทำให้เป็นตัวเลือกที่เหมาะสำหรับนักพัฒนาที่ต้องการเพิ่มความสามารถ OCR ให้กับโครงการของตน
เริ่มต้นใช้งาน Node-Tesseract-OCR
วิธีแนะนำในการติดตั้ง Node-Tesseract-OCR คือการใช้ npm. โปรดใช้คำสั่งต่อไปนี้เพื่อการติดตั้งที่ราบรื่น
ติดตั้ง Node-Tesseract-OCR ผ่าน npm
npm install node-tesseract-ocr คุณยังสามารถติดตั้งด้วยตนเองได้; ดาวน์โหลดไฟล์รุ่นล่าสุดโดยตรงจากคลัง GitHub.
การสกัดข้อความจากรูปภาพใน API ของ Node.js
ไลบรารีโอเพ่นซอร์ส Node-Tesseract-OCR ทำให้ผู้พัฒนาซอฟต์แวร์สร้างแอปพลิเคชันที่ดึงข้อความจากภาพโดยอัตโนมัติภายในแอปพลิเคชัน Node.js ได้อย่างง่ายดาย มันรองรับการดึงข้อความจากเอกสารสแกน, PDF, ภาพจากกล้อง หรือภาพใบเสร็จ นี่เป็นประโยชน์สำหรับการสร้างคลังข้อมูลที่สามารถค้นหาได้, การทำงานอัตโนมัติของการป้อนข้อมูล, หรือการประมวลผลเอกสารจำนวนมากในภาคส่วนเช่นการเงินและการดูแลสุขภาพ ต่อไปนี้คือตัวอย่างง่าย ๆ ที่แสดงวิธีการดึงข้อความจากภาพโดยโปรแกรมภายในแอปพลิเคชัน Node.js.
วิธีดึงข้อความจากรูปภาพในสภาพแวดล้อม Node.js?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
การเตรียมภาพล่วงหน้าที่ดีกว่าใน Node.js
การเตรียมภาพก่อนทำ OCR สามารถปรับปรุงความแม่นยำของการจดจำข้อความได้อย่างมีนัยสำคัญ ไลบรารีโอเพ่นซอร์ส Node-Tesseract-OCR รองรับเทคนิคการเตรียมภาพพื้นฐาน เช่น การปรับขนาด การทำไบนารีและการแก้ไขการเอียง ขั้นตอนการเตรียมภาพเหล่านี้สามารถนำไปใช้ร่วมกับไลบรารี Node.js เพิ่มเติมเช่น sharp หรือ jimp ควบคู่กับ Node-Tesseract-OCR ตัวอย่างต่อไปนี้แสดงให้เห็นว่าผู้พัฒนาซอฟต์แวร์ใช้ขั้นตอนการเตรียมภาพเพื่อปรับปรุงการจดจำอย่างไร โดยเฉพาะกับภาพคุณภาพต่ำ
วิธีใช้ขั้นตอนการเตรียมข้อมูลล่วงหน้าเพื่อปรับปรุงการจดจำผ่าน Node.js API?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
ข้อความที่ได้รับการจดจำในหลายภาษา
หนึ่งในคุณลักษณะที่โดดเด่นของ Node-Tesseract-OCR คือการสนับสนุนหลายภาษาอย่างครอบคลุม ไลบรารี Tesseract OCR รองรับมากกว่า 100 ภาษา ทำให้เป็นตัวเลือกที่เหมาะสำหรับแอปพลิเคชันที่ต้องประมวลผลเอกสารในหลายภาษา ผู้พัฒนาซอฟต์แวร์สามารถระบุภาษา(ภาษาที่)ต้องการให้ Tesseract ใช้ได้ เพื่อปรับปรุงความแม่นยำของการจดจำข้อความที่ไม่ใช่ภาษาอังกฤษ ต่อไปนี้คือตัวอย่างที่แสดงว่าผู้พัฒนาซอฟต์แวร์สามารถจดจำข้อความภาษาฝรั่งเศสในแอปพลิเคชัน Node.js ได้อย่างไร?
วิธีจดจำข้อความจากรูปภาพเป็นภาษาฝรั่งเศสผ่าน JavaScript API?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});