Безплатен Node.js API за добавяне на OCR възможности към JS проекти.
Отворена Node.js OCR библиотека, която позволява на програмистите да разпознават и извличат текст от различни файлови формати, включително изображения (JPEG, PNG), PDF файлове и документи безплатно на множество езици.
Какво е Node-Tesseract-OCR?
В днешната дигитална ера извличането на текст от изображения и документи се превърна в ключова задача в различни индустрии, включително управление на документи, обработка на данни и изкуствен интелект. Технологията за оптично разпознаване на знаци (OCR) направи възможно конвертирането на сканирани документи, изображения и PDF файлове в редактиращи се текстови формати. Node-Tesseract-OCR е отворен API, който включва мощността на OCR двигателя Tesseract, за да предостави безпроблемен и ефективен начин за изпълнение на OCR задачи в Node.js приложения.
Node-Tesseract-OCR е обвивка за Node.js на OCR двигателя Tesseract, позволяваща на софтуерните разработчици да използват мощните функции за разпознаване на текст на Tesseract в среда на Node.js. API‑то се поддържа в това GitHub хранилище и предлага набор от функционалности, които го правят подходящ за различни случаи на употреба, от просто извличане на текст до по-сложни задачи за обработка на документи. Софтуерните разработчици могат да извличат текст от изображения и документи на множество езици, което го прави универсален инструмент за различни приложения.
Node-Tesseract-OCR API предоставя разширени възможности за обработка на изображения, включително филтриране, преоразмеряване и изрязване, за да се гарантира, че извлеченият текст е точен и надежден. Той поддържа над 100 езика, което го прави универсално решение за OCR задачи в различни среди. Софтуерните разработчици могат да извличат текст от изображения, PDF файлове и документи и да връщат извлечения текст в различни формати, като JSON, XML и обикновен текст. Той е проектиран да бъде лек, гъвкав и лесен за използване, което го прави идеален избор за разработчици, които искат да добавят OCR възможности към своите проекти. Със своите разширени възможности за обработка на изображения, поддръжка на езици и механизми за обработка на грешки, той е идеален избор за разработчици, които искат да добавят OCR възможности към своите проекти.
Започване с Node-Tesseract-OCR
Препоръчителният начин за инсталиране на Node-Tesseract-OCR е чрез npm. Моля, използвайте следната команда за гладка инсталация.
Инсталирайте Node-Tesseract-OCR чрез npm
npm install node-tesseract-ocr Можете също да го инсталирате ръчно; изтеглете последните файлове за издание директно от GitHub хранилище.
Извличане на текст от изображения в Node.js API
Отвореният код на библиотеката Node-Tesseract-OCR улеснява софтуерните разработчици да създават приложения, които автоматично извличат текст от изображения в рамките на Node.js приложения. Тя поддържа извличане на текст от сканирани документи, PDF файлове, снимки, направени с камера, или снимки на разписки. Това може да бъде полезно за създаване на търсими архиви, автоматизиране на въвеждането на данни или обработка на големи обеми документи в сектори като финансите и здравеопазването. Ето прост пример, който показва как програмно да се извлече текст от изображения в Node.js приложения.
Как да извлечете текст от изображения в среда Node.js?
const tesseract = require("node-tesseract-ocr");
tesseract.recognize("path/to/image.jpg")
.then(text => {
console.log("Recognized Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Подобрена предварителна обработка на изображения в Node.js
Предварителната обработка на изображения преди прилагане на OCR може значително да подобри точността на разпознаването на текст. Отворената библиотека Node-Tesseract-OCR позволява базови техники за предварителна обработка, като преоразмеряване, бинаризация и изправяне. Тези стъпки за обработка могат да се реализират с помощта на допълнителни Node.js библиотеки като sharp или jimp в комбинация с Node-Tesseract-OCR. Следният пример показва как софтуерните разработчици използват стъпки за предварителна обработка, за да подобрят разпознаването, особено при изображения с по-ниско качество.
Как да приложите стъпки за предварителна обработка, за да подобрите разпознаването чрез Node.js API?
const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");
sharp("path/to/input.jpg")
.resize(800, 600) // Resize the image
.greyscale() // Convert to greyscale
.toBuffer()
.then(data => {
return tesseract.recognize(data, { lang: "eng" });
})
.then(text => {
console.log("Preprocessed Image Text:", text);
})
.catch(error => {
console.error("Error:", error.message);
});
Разпознат текст на множество езици
Една от отличителните характеристики на Node-Tesseract-OCR е обширната му поддръжка на множество езици. Библиотеката Tesseract OCR поддържа над 100 езика, което я прави идеален избор за приложения, които трябва да обработват документи на различни езици. Софтуерните разработчици могат да посочат езика(ите), които желаят Tesseract да използва, като подобряват точността на разпознаване за текстове, различни от английски. Ето пример, който показва как софтуерните разработчици могат да разпознават текст на френски в Node.js приложения?
Как да разпознаете текст от изображение на френски чрез JavaScript API?
const config = {
lang: "fra", // French language support
oem: 1,
psm: 3
};
tesseract.recognize("path/to/french-text-image.jpg", config)
.then(text => {
console.log("Recognized Text in French:", text);
})
.catch(error => {
console.error("Error:", error.message);
});