Avoimen lähdekoodin OCR JavaScript API haettavien PDF-tiedostojen luomiseen
Johtava JavaScript OCR -kirjasto haettavien PDF-tiedostojen luomiseen, joka suorittaa OCR:n (Optinen merkkien tunnistus) ja poimii tekstiä sekä kuvista (PNG, JPEG) että PDF-tiedostoista.
Mikä on Scribe.js?
Nykypäivän digitaalisessa maailmassa valtava määrä arvokasta tietoa on lukittuna kuvien sisään — virheilmoitusten kuvakaappauksia, asiakirjojen valokuvia, esityksen dioja tai jopa meemejä, joissa on nokkelaa tekstiä. Tämän tekstin manuaalinen litterointi on työläs ja virhealtti prosessi. Tässä kohtaa optinen merkintunnistus (OCR) -teknologia astuu pelastajaksi, ja Scribe.js tarjoaa yhden kehittäjäystävällisimmistä tavoista integroida se web-projekteihisi. Scribe.js on avoimen lähdekoodin JavaScript-kirjasto, joka suorittaa OCR:n ja poimii tekstiä sekä kuvista että PDF-tiedostoista. Toisin kuin monet OCR-ratkaisut, jotka vaativat taustaprosessointia tai ulkoisia API-kutsuja, Scribe.js toimii täysin asiakaspuolella, antaen sinulle täyden hallinnan dataasi ja poistaen palvelinkustannukset tekstintunnistustehtävissä.
Scribe.js on kevyt JavaScript-asiakasohjelma Google Cloud Vision API:lle. Kaikki OCR-toiminnot tapahtuvat suoraan käyttäjän selaimessa tai Node.js-ympäristössäsi, mikä takaa yksityisyyden ja vähentää palvelininfrastruktuurin kustannuksia. Kirjasto sisältää tukea erilaisille ominaisuuksille, kuten kuvien esikäsittely, yhtenäinen työnkulku kuville, automaattinen tunnistus, PDF-kerrostus, matalan luottamuksen sivujen suodatus, OCR-moottorien välimuisti ja niin edelleen. Kirjasto on rakennettu käyttäen modernia JavaScript ESM (ECMAScript Modules) -tekniikkaa, mikä tekee sen integroinnista nykyaikaisiin web-kehitystyövirtoihin suoraviivaista ilman monimutkaisia rakennusasetuksia. Tämä kehittäjäkeskeinen lähestymistapa tarkoittaa, että voit aloittaa tekstin poimimisen asiakirjoista vain muutamalla koodirivillä.
Aloittaminen Scribe.js:n kanssa
Suositeltu tapa asentaa Scribe.js on npm:n käyttö. Käytä seuraavaa komentoa sujuvaa asennusta varten
Asenna Scribe.js npm:n kautta
npm install scribe.js-ocr Voit myös asentaa sen manuaalisesti; lataa uusimmat julkaisutiedostot suoraan GitHub-varastosta.
Tekstin tunnistus kuvista
Scribe.js-kirjaston perustavanlaatuisin käyttötapa on tekstin poiminta kuvatiedostoista. Kirjasto tukee erilaisia kuvatiedostomuotoja ja pystyy käsittelemään sekä yksittäisiä kuvia että useiden kuvien eräitä yhdessä toiminnossa. Tässä on perusesimerkki, joka havainnollistaa tekstin poimintaa kuvan URL-osoitteesta JavaScript-sovelluksissa. Koodinpätkä esittelee Scribe.js:n tarjoaman yksinkertaisen API:n. extractText‑metodi hyväksyy taulukon kuva‑URL-osoitteita ja palauttaa lupauksen (Promise), joka ratkaisee tunnistetun tekstin.
Kuinka poimia teksti kuvasta JavaScript-kirjaston avulla?
import scribe from 'scribe.js-ocr';
// Extract text from a single image
scribe.extractText(['https://example.com/sample-image.png'])
.then((result) => {
console.log('Extracted text:', result);
})
.catch((error) => {
console.error('OCR failed:', error);
});
Luo haettavia PDF-tiedostoja JavaScriptin avulla
Yksi Scribe.js:n voimakkaimmista ominaisuuksista on sen kyky lisätä näkymättömiä tekstikerroksia olemassa oleviin PDF-tiedostoihin. Tämä toiminto muuntaa kuvapohjaiset PDF:t haettaviksi asiakirjoiksi muuttamatta niiden visuaalista ulkoasua. Kun PDF:ään lisätään tekstikerros, käyttäjät voivat hakea asiakirjasta tiettyjä sanoja tai lauseita, valita ja kopioida tekstiä siitä, miltä näyttää kuva, käyttää ruudunlukijoita ja saavutettavuustyökaluja skannatuissa asiakirjoissa, mahdollistaa hakukoneiden ja asiakirjahallintajärjestelmien indeksoinnin jne.
Kuinka luoda haettavia PDF-asiakirjoja JavaScript-kirjaston avulla?
import scribe from 'scribe.js-ocr';
// Add searchable text layer to an image-based PDF
async function makeSearchablePDF(inputPdfUrl) {
try {
// First, perform OCR on the PDF
const ocrResult = await scribe.extractText([inputPdfUrl]);
// Then create a new PDF with the text layer embedded
const searchablePdf = await scribe.createSearchablePDF(
inputPdfUrl,
ocrResult
);
// The resulting PDF maintains the original appearance
// but now contains selectable, searchable text
return searchablePdf;
} catch (error) {
console.error('Failed to create searchable PDF:', error);
throw error;
}
}
Edistynyt asiakirjan tekstintunnistus JavaScriptin avulla
Tiheää tekstiä ja monimutkaisia asetteluja sisältävien asiakirjakuvien (kuten skannattu kirjan sivu tai PDF-vienti) osalta Scribe.js-kirjasto tarjoaa "Document Text Detection" -ominaisuuden. Tämä tarjoaa paljon rikkaampaa tietoa, mukaan lukien kappale-, sana- ja rivinvaihtotunnistimet, mikä auttaa säilyttämään alkuperäisen asiakirjan rakenteen. Tämä on erittäin hyödyllistä sovelluksissa, joissa lähdemateriaalin asettelu ja rakenne ovat tärkeitä, kuten lomakkeiden, laskujen tai monisarakkeisten asettelujen käsittelyssä.
Kuinka suorittaa edistynyt tekstintunnistus JavaScript-sovelluksissa?
const Scribe = require('scribejs');
const serviceAccountKey = require('./path-to-your-key.json');
const scribe = new Scribe(serviceAccountKey);
const documentImageUrl = 'https://example.com/scanned-invoice.png';
// Use the `documentText` method for advanced detection
scribe.documentText(documentImageUrl)
.then(fullTextAnnotation => {
// The fullTextAnnotation object contains detailed data
console.log('Full Document Text:');
console.log(fullTextAnnotation.text); // The plain text of the entire document
// You can also iterate through pages, blocks, paragraphs, and words
fullTextAnnotation.pages.forEach(page => {
page.blocks.forEach(block => {
console.log('\nBlock Confidence:', block.confidence);
block.paragraphs.forEach(paragraph => {
console.log(paragraph.text);
});
});
});
})
.catch(error => {
console.error('Document OCR Error:', error);
});
Eräajoprosessointi useille tiedostoille JavaScriptin avulla
Reaaliaikaisissa sovelluksissa ohjelmistoprofessionaalien on usein käsiteltävä useita asiakirjoja samanaikaisesti. Scribe.js tukee eräprosessointia suoraan, jolloin käyttäjät voivat poimia tekstiä useista kuvista tai PDF-tiedostoista yhdellä toimenpiteellä JavaScript-sovelluksessa. Seuraava esimerkki osoittaa, miten ohjelmistokehittäjät voivat käsitellä asiakirjaerän JavaScript-komentoja käyttäen.
Kuinka käsitellä asiakirjapakkaus JavaScript-kirjaston avulla?
import scribe from 'scribe.js-ocr';
// Process multiple documents at once
async function batchProcess(fileUrls) {
try {
// Pass an array of URLs to process multiple files
const results = await scribe.extractText(fileUrls);
// Results are returned in the same order as input
results.forEach((text, index) => {
console.log(`Document ${index + 1} text:`, text);
});
return results;
} catch (error) {
console.error('Batch processing failed:', error);
throw error;
}
}
// Process a batch of documents
const documents = [
'https://example.com/receipt1.jpg',
'https://example.com/receipt2.jpg',
'https://example.com/invoice.pdf'
];
batchProcess(documents)
.then(allText => {
console.log('All documents processed successfully');
});