1. পণ্য
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

JS প্রকল্পে OCR ক্ষমতা যোগ করার জন্য ফ্রি Node.js API।

ওপেন সোর্স Node.js OCR লাইব্রেরি যা প্রোগ্রামারদের বিভিন্ন ফাইল ফরম্যাট, যেমন ইমেজ (JPEG, PNG), PDF এবং ডকুমেন্ট থেকে টেক্সট স্বীকৃতি ও এক্সট্র্যাক্ট করতে বহু ভাষায় বিনামূল্যে সক্ষম করে।

Node-Tesseract-OCR কি?

আজকের ডিজিটাল যুগে, ছবি এবং ডকুমেন্ট থেকে টেক্সট বের করা বিভিন্ন শিল্পে, যেমন ডকুমেন্ট ম্যানেজমেন্ট, ডেটা প্রসেসিং এবং কৃত্রিম বুদ্ধিমত্তা, একটি গুরুত্বপূর্ণ কাজ হয়ে উঠেছে। অপটিক্যাল ক্যারেক্টার রিকগনিশন (OCR) প্রযুক্তি স্ক্যান করা ডকুমেন্ট, ছবি এবং PDF গুলোকে সম্পাদনাযোগ্য টেক্সট ফরম্যাটে রূপান্তর করা সম্ভব করেছে। Node-Tesseract-OCR একটি ওপেন-সোর্স API যা টেসারাক্ট OCR ইঞ্জিনের শক্তি ব্যবহার করে Node.js অ্যাপ্লিকেশনগুলিতে OCR কাজগুলি নির্বিঘ্ন এবং কার্যকরভাবে সম্পাদনের উপায় প্রদান করে।

Node-Tesseract-OCR হল একটি Node.js র‍্যাপার Tesseract OCR ইঞ্জিনের জন্য, যা সফটওয়্যার ডেভেলপারদেরকে Node.js পরিবেশে Tesseract-এর শক্তিশালী টেক্সট স্বীকৃতি বৈশিষ্ট্যগুলি ব্যবহার করতে সক্ষম করে। APIটি এই GitHub রিপোজিটরিতে রক্ষণাবেক্ষণ করা হয় এবং বিভিন্ন কার্যকারিতা প্রদান করে যা এটিকে বিভিন্ন ব্যবহার ক্ষেত্রে উপযুক্ত করে, সহজ টেক্সট এক্সট্র্যাকশন থেকে আরও জটিল ডকুমেন্ট প্রসেসিং কাজ পর্যন্ত। সফটওয়্যার ডেভেলপাররা একাধিক ভাষায় ছবি এবং ডকুমেন্ট থেকে টেক্সট বের করতে পারেন, যা এটিকে বিভিন্ন অ্যাপ্লিকেশনের জন্য বহুমুখী টুল করে তোলে।

Node-Tesseract-OCR API উন্নত ইমেজ প্রক্রিয়াকরণ ক্ষমতা প্রদান করে, যার মধ্যে ইমেজ ফিল্টারিং, রিসাইজিং এবং ক্রপিং অন্তর্ভুক্ত, যাতে নিষ্কাশিত টেক্সট সঠিক এবং নির্ভরযোগ্য হয়। এটি ১০০টিরও বেশি ভাষা সমর্থন করে, যা বিভিন্ন পরিবেশে OCR কাজের জন্য একটি বহুমুখী সমাধান করে তোলে। সফটওয়্যার ডেভেলপাররা ইমেজ, PDF এবং ডকুমেন্ট থেকে টেক্সট নিষ্কাশন করতে পারে এবং নিষ্কাশিত টেক্সটকে JSON, XML এবং প্লেইন টেক্সটের মতো বিভিন্ন ফরম্যাটে ফেরত দিতে পারে। এটি হালকা, নমনীয় এবং ব্যবহার সহজভাবে ডিজাইন করা হয়েছে, যা ডেভেলপারদের তাদের প্রকল্পে OCR ক্ষমতা যুক্ত করতে চায় তাদের জন্য আদর্শ পছন্দ। এর উন্নত ইমেজ প্রক্রিয়াকরণ ক্ষমতা, ভাষা সমর্থন এবং ত্রুটি হ্যান্ডলিং মেকানিজমের সঙ্গে, এটি ডেভেলপারদের তাদের প্রকল্পে OCR ক্ষমতা যুক্ত করতে চায় তাদের জন্য আদর্শ পছন্দ।

Previous Next

Node-Tesseract-OCR দিয়ে শুরু করা

Node-Tesseract-OCR ইনস্টল করার সুপারিশকৃত পদ্ধতি হল npm ব্যবহার করা। মসৃণ ইনস্টলেশনের জন্য দয়া করে নিম্নলিখিত কমান্ডটি ব্যবহার করুন।

npm এর মাধ্যমে Node-Tesseract-OCR ইনস্টল করুন

npm install node-tesseract-ocr 

আপনি এটিও ম্যানুয়ালি ইনস্টল করতে পারেন; সর্বশেষ রিলিজ ফাইলগুলি সরাসরি GitHub রিপোজিটরি থেকে ডাউনলোড করুন।

Node.js API-তে ছবি থেকে টেক্সট বের করা

ওপেন সোর্স Node-Tesseract-OCR লাইব্রেরি সফটওয়্যার ডেভেলপারদের জন্য Node.js অ্যাপ্লিকেশনের মধ্যে ইমেজ থেকে স্বয়ংক্রিয়ভাবে টেক্সট বের করা সহজ করে দেয়। এটি স্ক্যান করা ডকুমেন্ট, PDF, ক্যামেরা ফটো বা রসিদের ফটো থেকে টেক্সট এক্সট্র্যাকশন সমর্থন করে। এটি অনুসন্ধানযোগ্য আর্কাইভ তৈরি, ডেটা এন্ট্রি স্বয়ংক্রিয় করা, অথবা আর্থিক ও স্বাস্থ্যসেবার মতো সেক্টরে বৃহৎ পরিমাণের ডকুমেন্ট প্রক্রিয়াকরণে সহায়ক হতে পারে। এখানে একটি সহজ উদাহরণ দেওয়া হল যা দেখায় কীভাবে প্রোগ্রাম্যাটিকভাবে Node.js অ্যাপ্লিকেশনের মধ্যে ইমেজ থেকে টেক্সট এক্সট্র্যাক্ট করা যায়।

কীভাবে Node.js পরিবেশের মধ্যে ছবি থেকে টেক্সট বের করবেন?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Node.js-এ উন্নত ইমেজ প্রি-প্রসেসিং

OCR প্রয়োগের আগে ছবিগুলোর প্রি-প্রসেসিং টেক্সট স্বীকৃতির নির্ভুলতা উল্লেখযোগ্যভাবে বাড়াতে পারে। ওপেন সোর্স Node-Tesseract-OCR লাইব্রেরি রিসাইজিং, বাইনারাইজেশন এবং ডেস্কিউইংয়ের মতো মৌলিক প্রি-প্রসেসিং কৌশলগুলিকে সমর্থন করে। এই প্রি-প্রসেসিং ধাপগুলো অতিরিক্ত Node.js লাইব্রেরি যেমন sharp বা jimp ব্যবহার করে Node-Tesseract-OCR এর সাথে যুক্ত করে বাস্তবায়ন করা যায়। নিম্নলিখিত উদাহরণটি দেখায় কীভাবে সফটওয়্যার ডেভেলপাররা প্রি-প্রসেসিং ধাপ ব্যবহার করে স্বীকৃতি উন্নত করে, বিশেষত নিম্নমানের ছবিগুলোর ক্ষেত্রে।

কীভাবে Node.js API এর মাধ্যমে স্বীকৃতি উন্নত করতে পূর্বপ্রক্রিয়াকরণ ধাপগুলি প্রয়োগ করবেন?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

বহু-ভাষায় স্বীকৃত টেক্সট

Node-Tesseract-OCR এর অন্যতম উল্লেখযোগ্য বৈশিষ্ট্য হল এর বিস্তৃত বহু-ভাষা সমর্থন। Tesseract OCR লাইব্রেরি ১০০টিরও বেশি ভাষা সমর্থন করে, যা বিভিন্ন ভাষায় ডকুমেন্ট প্রক্রিয়াকরণ প্রয়োজনীয় অ্যাপ্লিকেশনের জন্য আদর্শ পছন্দ করে তোলে। সফটওয়্যার ডেভেলপাররা Tesseract যে ভাষা(গুলি) ব্যবহার করবে তা নির্দিষ্ট করতে পারেন, যা ইংরেজি নয় এমন টেক্সটের স্বীকৃতি নির্ভুলতা বাড়ায়। এখানে একটি উদাহরণ দেওয়া হয়েছে যা দেখায় কীভাবে সফটওয়্যার ডেভেলপাররা Node.js অ্যাপ্লিকেশনে ফরাসি টেক্সট স্বীকৃত করতে পারে?

কীভাবে জাভাস্ক্রিপ্ট API ব্যবহার করে ফরাসি ভাষায় ছবির টেক্সট স্বীকৃত করবেন?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 বাংলা