1. Məhsullar
  2.   OCR
  3.   JavaScript
  4.   Guten OCR
 
  

Skann edilmiş şəkillər və formalardan mətn parsinqi üçün pulsuz JavaScript kitabxanası

Açıq mənbəli Optik Simvol Tanıma (OCR) JavaScript kitabxanası, Qara‑və‑Ağ skan edilmiş şəkillər və sənədlərdən mətn çıxarmaq üçün, Veb və ya Node.js tətbiqlərində Şəkil ön işlənməsi və Şablon dəstəyi ilə.

Modern rəqəmsal dünyada, optik simvol tanıma (OCR) texnologiyası skan edilmiş şəkilləri, əl yazısı qeydləri və ya çap olunmuş sənədləri redaktə edilə bilən və axtarılabilən məlumatlara çevirmədə kritik rol oynayır. Yüngül və açıq mənbəli həll axtaran JavaScript inkişaf etdiriciləri üçün Guten OCR cəlbedici bir seçim təklif edir. Bu JavaScript‑əsaslı OCR mühərriki sadəliyi nəzərə alaraq hazırlanıb, onu brauzer‑əsaslı və ya Node.js tətbiqlərinə OCR funksiyalarını birbaşa inteqrasiya etmək üçün ideal edir. Kitabxananın bir neçə vacib xüsusiyyəti var, məsələn, şablonlar vasitəsilə simvol tanıma, şəkil eşikləşdirmə və ikiliyə çevirmə, simvol seqmentasiyası, şablon uyğunluğu və mətn yığımı, modul kod bazası dəstəyi və s. O, qara‑ağ skan edilmiş sənədlərdə çap olunmuş mətnin tanınmasına yönəlib və kitablar və ya formalar kimi yaxşı formatlanmış mətnlər üçün ən uyğundur.

Guten OCR, Gutenye tərəfindən yaradılmış açıq mənbəli JavaScript OCR mühərrikidir. Çəkiyə görə ağır OCR alətlərindən fərqli olaraq, xarici asılılıqlar və ya geniş quraşdırma tələb etməyən Guten OCR tamamilə JavaScript-də yazılıb, yəni veb brauzerdə və ya Node.js ilə serverdə işləyə bilər. Kitabxana əsas şəkil emalı texnikalarından istifadə edərək simvolları seqmentləşdirir və onları simvol nümunə tanıma sistemi ilə müəyyən edir. Hələ ki, çoxdilli və ya əl yazısı mətn dəstəyi baxımından Tesseract kimi kommersiya OCR mühərrikləri ilə rəqabətə girməsə də, sadəliyi və hacklənə bilməsi onu təhsil layihələri, sübut konsepsiyaları və ya xüsusi veb tətbiqlərində gömülü OCR funksiyaları üçün fantastik seçim edir. Tesseract və ya digər böyük mühərriklərdən fərqli olaraq, Guten OCR məqsədli şəkildə yüngül və fokuslanmışdır — bu da OCR-in arxa planını anlamaq istəyənlər üçün mükəmməl başlanğıc nöqtəsi edir.

Previous Next

Guten OCR ilə Başlamaq

Guten OCR‑i quraşdırmağın tövsiyə olunan yolu Brew‑dən istifadə etməkdir. Sorunsuz quraşdırma üçün aşağıdakı əmri istifadə edin.

Guten OCR‑i Brew vasitəsilə quraşdırın

 brew install git-lfs 

Guten OCR-i GitHub vasitəsilə quraşdırın

 git clone git@github.com:gutenye/ocr.git 

Siz həmçinin onu əl ilə quraşdıra bilərsiniz; son buraxılış fayllarını birbaşa GitHub deposundan yükləyin.

OCR Əməliyyatlarından əvvəl Şəkil ön işlənməsi

Açıq mənbəli Guten OCR kitabxanası tamamilə JavaScript-də yazılıb, bu da onu həm brauzer, həm də Node.js mühitləri ilə uyğun edir. O, tanıma dəqiqliyini artırmaq üçün daxili şəkil ön işləmə funksiyalarını ehtiva edir. Şəkil Binarizasiyasını (qara və ağ rəngə çevirmə), səs-küy azaldılmasını, əyilmə düzəlişini və daha çoxunu dəstəkləyir. Aşağıdakı nümunə, inkişaf etdiricilərin şəkillərdə OCR əməliyyatını yerinə yetirməzdən əvvəl bir neçə şəkil ön işləmə addımını necə tətbiq edə biləcəyini göstərir.

JavaScript Kitabxanası vasitəsilə OCR Əməliyyatından əvvəl Şəkil Ön İşləməsini Necə Tətbiq Etmək?

const { preprocess } = require('guten-ocr');

// Apply multiple preprocessing steps
const processedImage = preprocess(imageData, [
  'grayscale',    // Convert to grayscale
  'binarize',     // Convert to black and white
  'deskew',       // Correct skew
  'denoise'       // Reduce noise
]);

// Then perform OCR on the processed image
ocr.recognize(processedImage).then(/* ... */);

Şablonlar vasitəsilə Simvol Tanıma

JavaScript kitabxanası Guten OCR, JavaScript tətbiqlərində şablonlardan istifadə edərək OCR əməliyyatlarını həyata keçirmək üçün tam dəstək təmin edir. Guten OCR-un əsasında şablon-uyğunluq sistemi dayanır. Maşın öyrənmə modelini öyrətmək əvəzinə, əvvəlcədən təyin edilmiş simvol nümunələrindən istifadə edir. Bu, sistemi daha sürətli və başa düşülməsi asan edir, lakin şrift və tərtibat uyğunluğuna daha həssas edir. Bu vəzifəni yerinə yetirmək üçün kitabxana hər bir simvolu (A–Z, a–z, 0–9, və s.) kanvasa çəkir və sonra hər bir simvol üçün ikili matris referans şablonu olur. Şəkili təhlil edərkən, kitabxana şəkil seqmentlərini bu şablonlarla müqayisə edərək ən uyğun uyğunluğu tapır. Bu, şaquli və üfüqi xətt skanlamasının birləşməsindən istifadə edərək sərhəd qutularını müəyyən edir.

OCR Kitabxanası vasitəsilə Simvol Seqmentasiyası

Açıq mənbəli JavaScript kitabxanası Guten OCR, proqram təminatı inkişaf etdiricilərinə simvol seqmentləşdirməsini asanlıqla həyata keçirməyə imkan verir. Şəkil ikili hala gətirildikdən sonra növbəti addım fərdi simvolları seqmentləşdirməkdir. Guten OCR, sıx qara piksel sahələrini aşkar etmək üçün sətir və sütunları skan edir və onları potensial simvollara ayırır. Aşağıdakı nümunə, proqram inkişaf etdiricilərinin JavaScript OCR kitabxanasından istifadə edərək simvol seqmentləşdirməsini necə həyata keçirə biləcəyini göstərir.

JavaScript Kitabxanası ilə Simvol Seqmentasiyasını Necə İcra Etmək?

const segment = require('guten-ocr/segment');
const boxes = segment(binarized); // returns array of [x, y, width, height]
 Azəri