1. สินค้า
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

API Node.js ฟรีเพื่อเพิ่มความสามารถ OCR ให้กับโครงการ JS

ไลบรารี OCR แบบโอเพนซอร์สสำหรับ Node.js ที่ช่วยให้นักพัฒนาสามารถจดจำและดึงข้อความจากรูปแบบไฟล์ต่าง ๆ รวมถึงรูปภาพ (JPEG, PNG), PDF, และเอกสารได้ฟรีในหลายภาษา

Node-Tesseract-OCR คืออะไร?

ในยุคดิจิทัลปัจจุบัน การดึงข้อความจากรูปภาพและเอกสารได้กลายเป็นงานที่สำคัญในหลายอุตสาหกรรม รวมถึงการจัดการเอกสาร การประมวลผลข้อมูล และปัญญาประดิษฐ์ เทคโนโลยีการจดจำอักขระด้วยแสง (OCR) ทำให้สามารถแปลงเอกสารสแกน รูปภาพ และไฟล์ PDF ให้เป็นรูปแบบข้อความที่แก้ไขได้ Node-Tesseract-OCR เป็น API แบบโอเพนซอร์สที่รวมพลังของเอนจิน Tesseract OCR เพื่อให้วิธีการทำงาน OCR ในแอปพลิเคชัน Node.js อย่างราบรื่นและมีประสิทธิภาพ

Node-Tesseract-OCR เป็น wrapper ของ Node.js สำหรับเครื่องมือ OCR Tesseract ที่ช่วยให้นักพัฒนาซอฟต์แวร์สามารถใช้คุณสมบัติการจดจำข้อความที่มีประสิทธิภาพของ Tesseract ภายในสภาพแวดล้อม Node.js API ถูกดูแลรักษาในที่เก็บ GitHub นี้และให้ฟังก์ชันการทำงานหลากหลายที่ทำให้เหมาะกับการใช้งานต่าง ๆ ตั้งแต่การสกัดข้อความอย่างง่ายจนถึงงานประมวลผลเอกสารที่ซับซ้อนมากขึ้น นักพัฒนาซอฟต์แวร์สามารถสกัดข้อความจากภาพและเอกสารในหลายภาษา ทำให้เป็นเครื่องมือที่หลากหลายสำหรับการใช้งานต่าง ๆ

API Node-Tesseract-OCR ให้ความสามารถในการประมวลผลภาพขั้นสูง รวมถึงการกรองภาพ การปรับขนาด และการตัดภาพ เพื่อให้ข้อความที่สกัดออกมามีความแม่นยำและเชื่อถือได้ รองรับภาษากว่า 100 ภาษา ทำให้เป็นโซลูชันที่หลากหลายสำหรับงาน OCR ในสภาพแวดล้อมที่หลากหลาย นักพัฒนาซอฟต์แวร์สามารถสกัดข้อความจากภาพ, PDF, และเอกสารต่าง ๆ และส่งคืนข้อความที่สกัดในรูปแบบต่าง ๆ เช่น JSON, XML, และข้อความธรรมดา ถูกออกแบบให้มีน้ำหนักเบา ยืดหยุ่น และใช้งานง่าย ทำให้เป็นตัวเลือกที่เหมาะสำหรับนักพัฒนาที่ต้องการเพิ่มความสามารถ OCR ให้กับโครงการของตน ด้วยความสามารถในการประมวลผลภาพขั้นสูง การสนับสนุนภาษา และกลไกการจัดการข้อผิดพลาด ทำให้เป็นตัวเลือกที่เหมาะสำหรับนักพัฒนาที่ต้องการเพิ่มความสามารถ OCR ให้กับโครงการของตน

Previous Next

เริ่มต้นใช้งาน Node-Tesseract-OCR

วิธีแนะนำในการติดตั้ง Node-Tesseract-OCR คือการใช้ npm. โปรดใช้คำสั่งต่อไปนี้เพื่อการติดตั้งที่ราบรื่น

ติดตั้ง Node-Tesseract-OCR ผ่าน npm

npm install node-tesseract-ocr 

คุณยังสามารถติดตั้งด้วยตนเองได้; ดาวน์โหลดไฟล์รุ่นล่าสุดโดยตรงจากคลัง GitHub.

การสกัดข้อความจากรูปภาพใน API ของ Node.js

ไลบรารีโอเพ่นซอร์ส Node-Tesseract-OCR ทำให้ผู้พัฒนาซอฟต์แวร์สร้างแอปพลิเคชันที่ดึงข้อความจากภาพโดยอัตโนมัติภายในแอปพลิเคชัน Node.js ได้อย่างง่ายดาย มันรองรับการดึงข้อความจากเอกสารสแกน, PDF, ภาพจากกล้อง หรือภาพใบเสร็จ นี่เป็นประโยชน์สำหรับการสร้างคลังข้อมูลที่สามารถค้นหาได้, การทำงานอัตโนมัติของการป้อนข้อมูล, หรือการประมวลผลเอกสารจำนวนมากในภาคส่วนเช่นการเงินและการดูแลสุขภาพ ต่อไปนี้คือตัวอย่างง่าย ๆ ที่แสดงวิธีการดึงข้อความจากภาพโดยโปรแกรมภายในแอปพลิเคชัน Node.js.

วิธีดึงข้อความจากรูปภาพในสภาพแวดล้อม Node.js?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

การเตรียมภาพล่วงหน้าที่ดีกว่าใน Node.js

การเตรียมภาพก่อนทำ OCR สามารถปรับปรุงความแม่นยำของการจดจำข้อความได้อย่างมีนัยสำคัญ ไลบรารีโอเพ่นซอร์ส Node-Tesseract-OCR รองรับเทคนิคการเตรียมภาพพื้นฐาน เช่น การปรับขนาด การทำไบนารีและการแก้ไขการเอียง ขั้นตอนการเตรียมภาพเหล่านี้สามารถนำไปใช้ร่วมกับไลบรารี Node.js เพิ่มเติมเช่น sharp หรือ jimp ควบคู่กับ Node-Tesseract-OCR ตัวอย่างต่อไปนี้แสดงให้เห็นว่าผู้พัฒนาซอฟต์แวร์ใช้ขั้นตอนการเตรียมภาพเพื่อปรับปรุงการจดจำอย่างไร โดยเฉพาะกับภาพคุณภาพต่ำ

วิธีใช้ขั้นตอนการเตรียมข้อมูลล่วงหน้าเพื่อปรับปรุงการจดจำผ่าน Node.js API?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

ข้อความที่ได้รับการจดจำในหลายภาษา

หนึ่งในคุณลักษณะที่โดดเด่นของ Node-Tesseract-OCR คือการสนับสนุนหลายภาษาอย่างครอบคลุม ไลบรารี Tesseract OCR รองรับมากกว่า 100 ภาษา ทำให้เป็นตัวเลือกที่เหมาะสำหรับแอปพลิเคชันที่ต้องประมวลผลเอกสารในหลายภาษา ผู้พัฒนาซอฟต์แวร์สามารถระบุภาษา(ภาษาที่)ต้องการให้ Tesseract ใช้ได้ เพื่อปรับปรุงความแม่นยำของการจดจำข้อความที่ไม่ใช่ภาษาอังกฤษ ต่อไปนี้คือตัวอย่างที่แสดงว่าผู้พัฒนาซอฟต์แวร์สามารถจดจำข้อความภาษาฝรั่งเศสในแอปพลิเคชัน Node.js ได้อย่างไร?

วิธีจดจำข้อความจากรูปภาพเป็นภาษาฝรั่งเศสผ่าน JavaScript API?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 ไทย