1. Ürün:% s
  2.   OCR
  3.   JavaScript
  4.   Guten OCR
 
  

Tarama Görüntülerinden ve Formlarından Metin Ayrıştırmak için Ücretsiz JavaScript Kütüphanesi

Web veya Node.js uygulamalarında Siyah‑Beyaz Tar scanned Görüntüler ve Belgelerden Metin Ayrıştırma için Görüntü Ön İşleme ve Şablon Desteği sağlayan Açık Kaynak Optik Karakter Tanıma (OCR) JavaScript kütüphanesi.

Modern dijital dünyada, optik karakter tanıma (OCR) teknolojisi taranmış görüntüleri, el yazısı notları veya basılı belgeleri düzenlenebilir ve aranabilir verilere dönüştürmede kritik bir rol oynar. Hafif ve açık kaynaklı bir çözüm arayan JavaScript geliştiricileri için Guten OCR çekici bir seçenek sunar. Bu JavaScript tabanlı OCR motoru sadelik düşünülerek tasarlanmıştır ve OCR özelliklerini doğrudan tarayıcı tabanlı veya Node.js uygulamalarına yerleştirmek için idealdir. Kütüphanenin içinde karakter tanıma şablonları, görüntü eşikleme ve ikilileştirme, karakter segmentasyonu, şablon eşleştirme ve metin birleştirme, modüler kod tabanı desteği gibi çeşitli önemli özellikler bulunur. Siyah-beyaz taranmış belgelerden basılı metin tanımaya odaklanır ve kitaplar veya formlar gibi iyi biçimlendirilmiş metinler için en uygunudur.

Guten OCR, Gutenye tarafından oluşturulan açık kaynaklı bir JavaScript OCR motorudur. Harici bağımlılıklar gerektiren veya kapsamlı kurulum gerektiren ağır OCR araçlarının aksine, Guten OCR tamamen JavaScript ile yazılmıştır, yani bir web tarayıcısında veya Node.js ile sunucuda çalışabilir. Kütüphane, karakterleri bölmek ve karakter desen tanıma sistemi kullanarak tanımlamak için temel görüntü işleme tekniklerini kullanır. Çok dilli veya el yazısı metin desteği açısından Tesseract gibi ticari OCR motorlarıyla henüz rekabet edemese de, sadeliği ve hacklenebilirliği, eğitim projeleri, kanıt konseptleri veya özel web uygulamalarında gömülü OCR özellikleri için harika bir seçenek yapar. Tesseract veya diğer büyük motorların aksine, Guten OCR kasıtlı olarak hafif ve odaklanmıştır—bu da OCR'nin nasıl çalıştığını anlamak isteyenler için mükemmel bir başlangıç noktasıdır.

Previous Next

Guten OCR'ye Başlarken

Guten OCR'yi kurmanın önerilen yolu Brew kullanmaktır. Sorunsuz bir kurulum için lütfen aşağıdaki komutu kullanın.

Guten OCR'yi Brew aracılığıyla kurun

 brew install git-lfs 

GitHub üzerinden Guten OCR'yi kurun

 git clone git@github.com:gutenye/ocr.git 

Ayrıca manuel olarak kurabilirsiniz; en son sürüm dosyalarını doğrudan GitHub deposundan indirin.

OCR İşlemlerinden Önce Görüntü Ön İşleme

Açık kaynak Guten OCR kütüphanesi tamamen JavaScript ile yazılmıştır, bu da tarayıcı ve Node.js ortamlarıyla uyumlu olmasını sağlar. Tanıma doğruluğunu artırmak için yerleşik görüntü ön işleme fonksiyonları içerir. Görüntü Binarizasyonu (siyah beyaza dönüştürme), gürültü azaltma, eğim düzeltme ve daha fazlasını destekler. Aşağıdaki örnek, geliştiricilerin görüntüler üzerinde OCR işlemi yapmadan önce birden fazla görüntü ön işleme adımını nasıl uygulayabileceğini gösterir.

JavaScript Kütüphanesi ile OCR İşleminden Önce Görüntü Ön İşleme Nasıl Uygulanır?

const { preprocess } = require('guten-ocr');

// Apply multiple preprocessing steps
const processedImage = preprocess(imageData, [
  'grayscale',    // Convert to grayscale
  'binarize',     // Convert to black and white
  'deskew',       // Correct skew
  'denoise'       // Reduce noise
]);

// Then perform OCR on the processed image
ocr.recognize(processedImage).then(/* ... */);

Şablonlar ile Karakter Tanıma

JavaScript kütüphanesi Guten OCR, JavaScript uygulamaları içinde şablonlar kullanarak OCR işlemleri gerçekleştirmek için tam destek sağlamıştır. Guten OCR'nin kalbinde bir şablon eşleştirme sistemi bulunur. Makine öğrenimi modeli eğitmek yerine, önceden tanımlanmış karakter desenlerini kullanır. Bu, sistemi daha hızlı ve anlaşılması daha kolay hâle getirir, ancak yazı tipi ve düzen tutarlılığına karşı daha hassas olur. Bu görevi yerine getirmek için kütüphane, her karakteri (A–Z, a–z, 0–9, vb.) bir canvas üzerinde render eder ve ardından her karakter için ikili matris bir referans şablonu haline gelir. Bir görüntüyü analiz ederken, kütüphane görüntü segmentlerini bu şablonlarla karşılaştırarak en iyi eşleşmeyi bulur. Bunu, sınırlayıcı kutuları bulmak için dikey ve yatay çizgi taramasının bir kombinasyonunu kullanarak yapar.

OCR Kütüphanesi ile Karakter Segmentasyonu

Açık kaynak JavaScript kütüphanesi Guten OCR, yazılım geliştiricilerin karakter segmentasyonu yapmasını kolaylaştırır. Görüntü ikili hale getirildikten sonra bir sonraki adım, tek tek karakterleri bölmektir. Guten OCR, yoğun siyah piksel bölgelerini tespit etmek için satır ve sütunları tarar ve bunları potansiyel karakterlere ayırır. Aşağıdaki örnek, yazılım geliştiricilerin JavaScript OCR kütüphanesini kullanarak karakter segmentasyonu nasıl gerçekleştirebileceklerini gösterir.

JavaScript Kütüphanesi Kullanarak Karakter Segmentasyonu Nasıl Yapılır?

const segment = require('guten-ocr/segment');
const boxes = segment(binarized); // returns array of [x, y, width, height]
 Türkçe