1. Ürün:% s
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

JS Projelerine OCR Yeteneği Eklemek İçin Ücretsiz Node.js API'si.

Açık Kaynak Node.js OCR Kütüphanesi, programcıların çeşitli dosya formatlarından, Görüntüler (JPEG, PNG), PDF'ler ve Belgeler dahil, çoklu dillerde ücretsiz olarak metin tanımasını ve çıkarmasını sağlar.

Node-Tesseract-OCR Nedir?

Bugünün dijital çağında, görüntülerden ve belgelerden metin çıkarmak, belge yönetimi, veri işleme ve yapay zeka dahil olmak üzere çeşitli sektörlerde kritik bir görev haline gelmiştir. Optik Karakter Tanıma (OCR) teknolojisi, taranmış belgeleri, görüntüleri ve PDF'leri düzenlenebilir metin formatlarına dönüştürmeyi mümkün kılmıştır. Node-Tesseract-OCR, Tesseract OCR motorunun gücünü birleştiren açık kaynaklı bir API olup, Node.js uygulamalarında OCR görevlerini sorunsuz ve verimli bir şekilde gerçekleştirmek için bir çözüm sunar.

Node-Tesseract-OCR, Tesseract OCR motoru için bir Node.js sarmalayıcısıdır ve yazılım geliştiricilerin Tesseract'ın güçlü metin tanıma özelliklerini bir Node.js ortamında kullanmalarını sağlar. API, bu GitHub deposunda sürdürülmekte ve basit metin çıkarımından daha karmaşık belge işleme görevlerine kadar çeşitli kullanım senaryolarına uygun bir dizi işlevsellik sunar. Yazılım geliştiriciler, görüntülerden ve belgelerden birden fazla dilde metin çıkarabilir, bu da onu çeşitli uygulamalar için çok yönlü bir araç haline getirir.

Node-Tesseract-OCR API, görüntü filtreleme, yeniden boyutlandırma ve kırpma gibi gelişmiş görüntü işleme yetenekleri sunar; böylece çıkarılan metnin doğru ve güvenilir olmasını sağlar. 100'den fazla dili destekler, bu da onu çeşitli ortamlar için çok yönlü bir OCR çözümü yapar. Yazılım geliştiricileri görüntülerden, PDF'lerden ve belgelerden metin çıkarabilir ve çıkarılan metni JSON, XML ve düz metin gibi çeşitli formatlarda döndürebilir. Hafif, esnek ve kullanımı kolay olacak şekilde tasarlanmıştır; bu da projelerine OCR yetenekleri eklemek isteyen geliştiriciler için ideal bir seçimdir. Gelişmiş görüntü işleme yetenekleri, dil desteği ve hata yönetim mekanizmalarıyla, projelerine OCR yetenekleri eklemek isteyen geliştiriciler için ideal bir seçimdir.

Previous Next

Node-Tesseract-OCR ile Başlarken

Node-Tesseract-OCR'yi kurmanın önerilen yolu npm kullanmaktır. Sorunsuz bir kurulum için lütfen aşağıdaki komutu kullanın.

Node-Tesseract-OCR'yi npm üzerinden kurun

npm install node-tesseract-ocr 

Ayrıca manuel olarak da kurabilirsiniz; en son sürüm dosyalarını doğrudan GitHub deposundan indirin.

Node.js API'de Görüntülerden Metin Çıkarma

Açık kaynak Node-Tesseract-OCR kütüphanesi, yazılım geliştiricilerin Node.js uygulamaları içinde görüntülerden otomatik olarak metin çıkaran uygulamalar oluşturmasını kolaylaştırır. Tarama belgeleri, PDF'ler, kamera fotoğrafları veya fiş fotoğraflarından metin çıkarımını destekler. Bu, aranabilir arşivler oluşturmak, veri girişini otomatikleştirmek veya finans ve sağlık gibi sektörlerde büyük miktarda belge işlemek için faydalı olabilir. İşte Node.js uygulamaları içinde görüntülerden programlı olarak metin çıkarımını gösteren basit bir örnek.

Node.js Ortamında Görüntülerden Metin Nasıl Çıkarılır?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Node.js içinde Daha İyi Görüntü Ön İşleme

OCR uygulamadan önce görüntüleri ön işleme yapmak, metin tanıma doğruluğunu önemli ölçüde artırabilir. Açık kaynaklı Node-Tesseract-OCR kütüphanesi, yeniden boyutlandırma, ikilileştirme ve eğrilik düzeltme gibi temel ön işleme tekniklerine izin verir. Bu ön işleme adımları, sharp veya jimp gibi ek Node.js kütüphaneleriyle Node-Tesseract-OCR ile birlikte uygulanabilir. Aşağıdaki örnek, yazılım geliştiricilerin özellikle düşük kaliteli görüntülerde tanımayı iyileştirmek için ön işleme adımlarını nasıl kullandığını gösterir.

Node.js API'si ile Tanıma İyileştirmek İçin Ön İşleme Adımları Nasıl Uygulanır?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Çok Dilde Tanınan Metin

Node-Tesseract-OCR'nin öne çıkan özelliklerinden biri, kapsamlı çoklu dil desteğidir. Tesseract OCR kütüphanesi 100'den fazla dili destekler, bu da çeşitli dillerde belgeleri işlemek zorunda olan uygulamalar için ideal bir seçim yapar. Yazılım geliştiricileri, Tesseract'in kullanmasını istedikleri dil(ler)i belirtebilir, böylece İngilizce dışı metinlerin tanıma doğruluğu artar. İşte, yazılım geliştiricilerin Node.js uygulamaları içinde Fransızca metni tanıyabildiklerini gösteren bir örnek?

JavaScript API'si ile Fransızca Görüntüden Metin Nasıl Tanınır?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 Türkçe