1. Товары
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

Бесплатный API Node.js для добавления возможностей OCR в проекты на JavaScript.

Открытая библиотека OCR для Node.js, позволяющая программистам распознавать и извлекать текст из различных форматов файлов, включая изображения (JPEG, PNG), PDF и документы, бесплатно и на нескольких языках.

Что такое Node-Tesseract-OCR?

В современную цифровую эпоху извлечение текста из изображений и документов стало важной задачей в различных отраслях, включая управление документами, обработку данных и искусственный интеллект. Технология оптического распознавания символов (OCR) сделала возможным преобразование отсканированных документов, изображений и PDF‑файлов в редактируемые текстовые форматы. Node-Tesseract-OCR — это открытый API, который использует мощность движка Tesseract OCR, предоставляя бесшовный и эффективный способ выполнения OCR‑задач в приложениях Node.js.

Node-Tesseract-OCR — это обёртка для Node.js над движком OCR Tesseract, позволяющая разработчикам программного обеспечения использовать мощные функции распознавания текста Tesseract в среде Node.js. API поддерживается в этом репозитории GitHub и предлагает широкий набор функций, делающих его подходящим для различных сценариев использования, от простого извлечения текста до более сложных задач обработки документов. Разработчики могут извлекать текст из изображений и документов на нескольких языках, что делает его универсальным инструментом для различных приложений.

API Node-Tesseract-OCR предоставляет расширенные возможности обработки изображений, включая фильтрацию, изменение размера и обрезку, чтобы обеспечить точность и надёжность извлечённого текста. Он поддерживает более 100 языков, что делает его универсальным решением для задач OCR в различных средах. Разработчики программного обеспечения могут извлекать текст из изображений, PDF и документов и возвращать извлечённый текст в различных форматах, таких как JSON, XML и обычный текст. Он разработан как лёгкий, гибкий и простой в использовании, что делает его идеальным выбором для разработчиков, желающих добавить возможности OCR в свои проекты. Благодаря расширенным возможностям обработки изображений, поддержке языков и механизмам обработки ошибок, он является идеальным выбором для разработчиков, желающих добавить возможности OCR в свои проекты.

Previous Next

Начало работы с Node-Tesseract-OCR

Рекомендуемый способ установки Node-Tesseract-OCR — использовать npm. Пожалуйста, используйте следующую команду для беспроблемной установки

Установите Node-Tesseract-OCR через npm

npm install node-tesseract-ocr 

Вы также можете установить его вручную; загрузите последние файлы релиза напрямую из репозитория GitHub.

Извлечение текста из изображений в API Node.js

Открытая библиотека Node-Tesseract-OCR упрощает разработчикам программного обеспечения создание приложений, которые автоматически извлекают текст из изображений в приложениях Node.js. Она поддерживает извлечение текста из отсканированных документов, PDF, фотографий, сделанных камерой, или фотографий чеков. Это может быть полезно для создания поисковых архивов, автоматизации ввода данных или обработки больших объёмов документов в таких секторах, как финансы и здравоохранение. Ниже приведён простой пример, показывающий, как программно извлекать текст из изображений в приложениях Node.js.

Как извлечь текст из изображений в среде Node.js?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Улучшенная предобработка изображений в Node.js

Предобработка изображений перед применением OCR может значительно повысить точность распознавания текста. Открытая библиотека Node-Tesseract-OCR позволяет использовать базовые методы предобработки, такие как изменение размера, бинаризация и исправление наклона. Эти шаги предобработки можно реализовать с помощью дополнительных библиотек Node.js, таких как sharp или jimp, в сочетании с Node-Tesseract-OCR. Следующий пример показывает, как разработчики программного обеспечения используют шаги предобработки для улучшения распознавания, особенно при работе с изображениями низкого качества.

Как применить шаги предобработки для улучшения распознавания через API Node.js?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Распознанный текст на нескольких языках

Одной из выдающихся особенностей Node-Tesseract-OCR является его обширная поддержка множества языков. Библиотека Tesseract OCR поддерживает более 100 языков, что делает её идеальным выбором для приложений, которым необходимо обрабатывать документы на разных языках. Разработчики могут указывать язык(и), которые Tesseract должен использовать, повышая точность распознавания для текстов не на английском. Вот пример, который показывает, как разработчики могут распознавать текст на французском внутри приложений Node.js?

Как распознать текст с изображения на французском языке через JavaScript API?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 Русский