Leabharlann JavaScript Saor in Aisce chun Téacs a Pharsáil ó Íomhánna & Foirmeacha Scannta
Leabharlann JavaScript Léitheoireacht Optúil Carachtar (OCR) Foinse Oscailte chun Téacs a Pharsáil ó Íomhánna Scanáilte Dubh-&-Bán & Cáipéisí le Réamhphróiseáil Íomhá & Tacaíocht Teimpléad i nAipeanna Gréasáin nó Node.js Apps.
Sa domhan digiteach nua-aimseartha, tá teicneolaíocht aithint carachtar optúil (OCR) ag glacadh ról criticiúil i dtiontú íomhánna scanáilte, nótaí lámhscríofa, nó cáipéisí priontáilte go sonraí inathraithe agus inathbharthana. D'fhógróirí JavaScript atá ag lorg réiteach éadrom agus foinse oscailte, cuireann Guten OCR rogha tarraingteach ar fáil. Tá an t-inneall OCR seo bunaithe ar JavaScript deartha le simplíocht i gcuimhne, rud a fhágann go bhfuil sé idéalach chun gnéithe OCR a leabú go díreach i bhfeidhmchláir brabhsálaí nó Node.js. Tá roinnt gnéithe tábhachtacha mar chuid den leabharlann, mar shampla aithint carachtar trí teimpléid, tairseachú íomhá agus dénárú, deighilt carachtar, comhoiriúint teimpléid agus tiomsú téacs, tacaíocht cód-mhodúil agus mar sin de. Tá sé dírithe ar aithint téacs priontáilte ó cháipéisí scanáilte dubh-agus-bán agus tá sé is fearr le haghaidh téacs dea-fhormáidithe, mar leabhair nó foirmeacha.
Is innill OCR JavaScript foinse oscailte é Guten OCR a chruthaigh Gutenye. Níos mó ná uirlisí OCR tromchúiseacha a éilíonn spleáchais sheachtracha nó socrú fairsing, tá Guten OCR scríofa go hiomlán i JavaScript, rud a chiallaíonn gur féidir é a rith i mbrabhsálaí gréasáin nó ar an bhfreastalaí le Node.js. Úsáideann an leabharlann teicnící bunúsacha próiseála íomhá chun carachtair a roinn agus iad a aithint ag baint úsáide as córas aitheanta patrúin carachtar. Cé nach gcomórtasóidh sé fós le hinnill OCR tráchtála mar Tesseract i dtaca le tacaíocht téacs ilteangach nó lámhscríofa, tá a shimplíocht agus a inrochtaineacht áisiúil go hiontach do thionscnaimh oideachais, cruthúnas-choincheap, nó gnéithe OCR leabaithe i bhfeidhmchláir ghréasáin saincheaptha. Níos mó ná Tesseract nó innill níos mó eile, tá Guten OCR éadrom agus dírithe go sonrach — rud a fhágann sé mar phointe tosaigh den scoth do dhaoine ar mian leo tuiscint a fháil ar conas a oibríonn OCR faoi bhun.
Ag Tosú le Guten OCR
Is é an bealach molta chun Guten OCR a shuiteáil ná úsáid a bhaint as Brew. Úsáid an t-ordú seo a leanas le haghaidh suiteála réidh.
Suiteáil Guten OCR trí Brew
brew install git-lfs Suiteáil Guten OCR trí GitHub
git clone git@github.com:gutenye/ocr.git Is féidir leat é a shuiteáil de láimh freisin; íosluchtaigh na comhaid eisiúna is déanaí go díreach ó stór GitHub.
Réamhphróiseáil Íomhá Roimh Oibríochtaí OCR
Tá leabharlann open source Guten OCR scríofa go hiomlán i JavaScript, rud a fhágann go bhfuil sé comhoiriúnach le timpeallachtaí brabhsálaí agus Node.js araon. Cuimsíonn sé feidhmeanna réamhphróiseála íomhá ionsuite chun cruinneas aitheantais a fheabhsú. Tacaíonn sé le Binarú íomhá (ag iompú go dubh agus bán), laghdú torainn, ceartú claonta agus tuilleadh. Léiríonn an sampla thíos conas is féidir le forbróirí céimeanna ilroimhphróiseála íomhá a chur i bhfeidhm sula ndéantar oibríocht OCR ar íomhánna.
Conas Réamhphróiseáil Íomhá a chur i bhfeidhm roimh Oibríocht OCR trí Leabharlann JavaScript?
const { preprocess } = require('guten-ocr');
// Apply multiple preprocessing steps
const processedImage = preprocess(imageData, [
'grayscale', // Convert to grayscale
'binarize', // Convert to black and white
'deskew', // Correct skew
'denoise' // Reduce noise
]);
// Then perform OCR on the processed image
ocr.recognize(processedImage).then(/* ... */);
Aithint Carachtar trí Theimpléid
Tá an leabharlann JavaScript Guten OCR tar éis tacaíocht iomlán a sholáthar chun oibríochtaí OCR a dhéanamh ag baint úsáide as teimpléid laistigh de fheidhmchláir JavaScript. Sa lár de Guten OCR tá córas meaitseála teimpléid. In áit a oiliúint múnla foghlama meaisín, úsáideann sé patrúin carachtar réamhshainithe. Cuireann sé seo an córas níos tapúla agus níos éasca le tuiscint ach níos íogaire do chomhionannas cló agus leagan amach. Chun an tasc seo a chur i gcrích, rindreann an leabharlann gach carachtar (A–Z, a–z, 0–9, srl.) i chanbhás agus ansin éiríonn an mátrís dhénártha do gach carachtar ina teimpléad tagartha. Nuair a dhéantar íomhá a anailísiú, comparann an leabharlann deighiltí íomhá i gcoinne na dteimpléid seo chun an meaitseáil is fearr a aimsiú. Déanann sé seo ag baint úsáide as meascán de scanadh línte ingearacha agus cothrománacha chun boscaí teorann a aimsiú.
Deighilt Carachtar trí Leabharlann OCR
Cuireann an leabharlann JavaScript cód foinse oscailte Guten OCR ar chumas forbróirí bogearraí deighilt carachtar a dhéanamh go héasca. Nuair a bhíonn an íomhá dénártha, is é an chéad chéim eile deighilt carachtair aonair. Scanann Guten OCR rótaí agus colúin chun réigiúin le picteilíní dubha dlúth a bhrath, ag iad a scaradh i gcarachtair féideartha. Léiríonn an sampla thíos conas is féidir le forbróirí bogearraí deighilt carachtar a dhéanamh ag baint úsáide as leabharlann OCR JavaScript.
Conas Deighilt Carachtar a Dhéanamh ag baint úsáide as Leabharlann JavaScript?
const segment = require('guten-ocr/segment');
const boxes = segment(binarized); // returns array of [x, y, width, height]