1. Produkter
  2.   OCR
  3.   JavaScript
  4.   Scribe.js
 
  

Åpen kildekode OCR JavaScript API for å opprette søkbare PDF-er

Et ledende JavaScript OCR-bibliotek for å opprette søkbare PDF-er og utfører OCR (Optisk Tegngjenkjenning) og henter ut tekst fra både bilder (PNG, JPEG) og PDF-filer.

Hva er Scribe.js?

I dagens digitale verden er en enorm mengde verdifull informasjon fanget i bilder—skjermbilder av feilmeldinger, fotografier av dokumenter, lysbilder fra en presentasjon, eller til og med memes med smart tekst. Å transkribere denne teksten manuelt er en tidkrevende og feilutsatt prosess. Det er her optisk tegngjenkjenning (OCR) teknologi kommer til unnsetning, og Scribe.js tilbyr en av de mest utviklervennlige måtene å integrere den i dine webprosjekter på. Scribe.js er et åpen kildekode JavaScript-bibliotek som utfører OCR og henter tekst fra både bilder og PDF-filer. I motsetning til mange OCR-løsninger som krever backend-behandling eller eksterne API‑kall, kjører Scribe.js helt på klientsiden, gir deg full kontroll over dataene dine og eliminerer serverkostnader for tekstgjenkjenningsoppgaver.

Scribe.js er en lettvekts JavaScript-klient for Google Cloud Vision API. Alle OCR-operasjoner skjer direkte i brukerens nettleser eller ditt Node.js-miljø, noe som sikrer personvern og reduserer kostnader for serverinfrastruktur. Biblioteket har inkludert støtte for ulike funksjoner, som å forhåndsbehandle bildene dine, enhetlig arbeidsflyt for bilder, automatisk gjenkjenning, PDF-lagdeling, filtrere ut sider med lav tillit, cache OCR-motorer osv. Biblioteket er bygget med moderne JavaScript ESM (ECMAScript Modules), noe som gjør det enkelt å integrere i moderne webutviklingsarbeidsflyter uten å kreve komplekse byggekonfigurasjoner. Denne utvikler‑første tilnærmingen betyr at du kan begynne å trekke ut tekst fra dokumenter med bare noen få linjer kode.

Previous Next

Kom i gang med Scribe.js

Den anbefalte måten å installere Scribe.js på er ved å bruke npm. Vennligst bruk følgende kommando for en smidig installasjon

Installer Scribe.js via npm

 npm install scribe.js-ocr 

Du kan også installere det manuelt; last ned de nyeste utgivelsesfilene direkte fra GitHub-depotet.

Tekstgjenkjenning fra bilder

Det mest grunnleggende bruksområdet for Scribe.js-biblioteket er å hente tekst fra bildefiler. Biblioteket håndterer ulike bildeformater og kan behandle både enkeltbilder og batcher med flere bilder i én operasjon. Her er et enkelt eksempel som demonstrerer tekstuttrekk fra en bilde-URL i JavaScript‑apper. Kodesnutten viser det enkle API‑et som Scribe.js tilbyr. extractText‑metoden godtar en matrise av bilde‑URLer og returnerer et Promise som løses med den gjenkjente teksten.

Hvordan hente tekst fra et bilde via JavaScript-bibliotek?

import scribe from 'scribe.js-ocr';

// Extract text from a single image
scribe.extractText(['https://example.com/sample-image.png'])
  .then((result) => {
    console.log('Extracted text:', result);
  })
  .catch((error) => {
    console.error('OCR failed:', error);
  });

Lag søkbare PDF-er via JavaScript

En av de mest kraftfulle funksjonene i Scribe.js er evnen til å legge til usynlige tekstlag i eksisterende PDF‑filer. Denne funksjonaliteten gjør bildebaserte PDF‑filer om til søkbare dokumenter uten å endre deres visuelle utseende. Når et tekstlag legges til en PDF, kan brukere søke etter spesifikke ord eller uttrykk i dokumentet, velge og kopiere tekst fra det som ser ut som et bilde, bruke skjermlesere og tilgjengelighetsverktøy med skannede dokumenter, aktivere indeksering av søkemotorer og dokumenthåndteringssystemer osv.

Hvordan lage søkbare PDF-dokumenter via JavaScript-bibliotek?

import scribe from 'scribe.js-ocr';

// Add searchable text layer to an image-based PDF
async function makeSearchablePDF(inputPdfUrl) {
  try {
    // First, perform OCR on the PDF
    const ocrResult = await scribe.extractText([inputPdfUrl]);
    
    // Then create a new PDF with the text layer embedded
    const searchablePdf = await scribe.createSearchablePDF(
      inputPdfUrl,
      ocrResult
    );
    
    // The resulting PDF maintains the original appearance
    // but now contains selectable, searchable text
    return searchablePdf;
  } catch (error) {
    console.error('Failed to create searchable PDF:', error);
    throw error;
  }
}

Avansert dokumenttekstgjenkjenning via JS

For bilder av dokumenter med tett tekst og komplekse oppsett (som en skannet bokside eller en PDF‑eksport), tilbyr Scribe.js‑biblioteket en \"Document Text Detection\"‑funksjon. Denne gir mye rikere informasjon, inkludert avsnitt‑, ord‑ og linjeskift‑detektorer, som hjelper med å bevare strukturen i det originale dokumentet. Dette er ekstremt nyttig for applikasjoner hvor oppsettet og strukturen til kilde­materialet er viktig, for eksempel ved behandling av skjemaer, fakturaer eller flerkolonne‑oppsett.

Hvordan utføre avansert tekstdeteksjon i JavaScript-apper?

const Scribe = require('scribejs');
const serviceAccountKey = require('./path-to-your-key.json');
const scribe = new Scribe(serviceAccountKey);

const documentImageUrl = 'https://example.com/scanned-invoice.png';

// Use the `documentText` method for advanced detection
scribe.documentText(documentImageUrl)
  .then(fullTextAnnotation => {
    // The fullTextAnnotation object contains detailed data
    console.log('Full Document Text:');
    console.log(fullTextAnnotation.text); // The plain text of the entire document

    // You can also iterate through pages, blocks, paragraphs, and words
    fullTextAnnotation.pages.forEach(page => {
      page.blocks.forEach(block => {
        console.log('\nBlock Confidence:', block.confidence);
        block.paragraphs.forEach(paragraph => {
          console.log(paragraph.text);
        });
      });
    });
  })
  .catch(error => {
    console.error('Document OCR Error:', error);
  });

Batchbehandling av flere filer via JavaScript

I virkelige applikasjoner trenger programvareprofesjonelle ofte å behandle flere dokumenter samtidig. Scribe.js støtter batch‑behandling rett fra start, og gjør det mulig for brukere å hente ut tekst fra flere bilder eller PDF‑filer i en enkelt operasjon innen en JavaScript‑applikasjon. Det følgende eksemplet viser hvordan programvareutviklere kan behandle en batch av dokumenter ved hjelp av JavaScript‑kommandoer.

Hvordan behandle en batch med dokumenter ved hjelp av JavaScript-bibliotek?

import scribe from 'scribe.js-ocr';

// Process multiple documents at once
async function batchProcess(fileUrls) {
  try {
    // Pass an array of URLs to process multiple files
    const results = await scribe.extractText(fileUrls);
    
    // Results are returned in the same order as input
    results.forEach((text, index) => {
      console.log(`Document ${index + 1} text:`, text);
    });
    
    return results;
  } catch (error) {
    console.error('Batch processing failed:', error);
    throw error;
  }
}

// Process a batch of documents
const documents = [
  'https://example.com/receipt1.jpg',
  'https://example.com/receipt2.jpg',
  'https://example.com/invoice.pdf'
];

batchProcess(documents)
  .then(allText => {
    console.log('All documents processed successfully');
  });
 Norsk