1. 产品
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

免费 Node.js API,为 JS 项目添加 OCR 功能。

开源 Node.js OCR 库,允许程序员免费识别并提取多语言的各种文件格式(包括图像(JPEG、PNG)、PDF 和文档)中的文本。

Node-Tesseract-OCR 是什么?

在当今的数字时代,从图像和文档中提取文本已成为各行业的关键任务,包括文档管理、数据处理和人工智能。光学字符识别(OCR)技术使得将扫描的文档、图像和 PDF 转换为可编辑的文本格式成为可能。Node-Tesseract-OCR 是一个开源 API,结合了 Tesseract OCR 引擎的强大功能,为在 Node.js 应用中执行 OCR 任务提供了无缝且高效的解决方案。

Node-Tesseract-OCR 是 Tesseract OCR 引擎的 Node.js 包装器,使软件开发者能够在 Node.js 环境中利用 Tesseract 强大的文本识别功能。该 API 在此 GitHub 仓库维护,提供一系列功能,适用于各种使用场景,从简单的文本提取到更复杂的文档处理任务。软件开发者可以从图像和文档中提取多语言文本,使其成为多种应用的多功能工具。

Node-Tesseract-OCR API 提供先进的图像处理功能,包括图像过滤、调整大小和裁剪,以确保提取的文本准确可靠。它支持超过 100 种语言,使其成为在多种环境中进行 OCR 任务的多功能解决方案。软件开发者可以从图像、PDF 和文档中提取文本,并以多种格式返回提取的文本,如 JSON、XML 和纯文本。它被设计为轻量、灵活且易于使用,是希望在项目中添加 OCR 功能的开发者的理想选择。凭借其先进的图像处理能力、语言支持和错误处理机制,它是希望在项目中添加 OCR 功能的开发者的理想选择。

Previous Next

Node-Tesseract-OCR 入门指南

推荐的 Node-Tesseract-OCR 安装方式是使用 npm。请使用以下命令进行顺利安装

通过 npm 安装 Node-Tesseract-OCR

npm install node-tesseract-ocr 

您也可以手动安装;直接从 GitHub 仓库下载最新的发布文件。

Node.js API 中的图像文本提取

开源的 Node-Tesseract-OCR 库使软件开发者能够轻松创建在 Node.js 应用中自动从图像中提取文本的应用程序。它支持从扫描文档、PDF、相机照片或收据照片中提取文本。这对于创建可搜索的档案、自动化数据录入,或在金融和医疗等行业处理大量文档非常有用。下面是一个简单示例,展示如何在 Node.js 应用中以编程方式从图像中提取文本。

如何在 Node.js 环境中从图像中提取文本?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

在 Node.js 中进行更好的图像预处理

在应用 OCR 之前对图像进行预处理可以显著提高文本识别的准确性。开源的 Node-Tesseract-OCR 库支持基本的预处理技术,如调整大小、二值化和去倾斜。这些预处理步骤可以结合 Node-Tesseract-OCR 使用额外的 Node.js 库,如 sharp 或 jimp 来实现。以下示例展示了软件开发者如何使用预处理步骤来提升识别效果,特别是针对低质量图像。

如何通过 Node.js API 应用预处理步骤以提升识别效果?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

多语言识别文本

Node-Tesseract-OCR 的突出特点之一是其广泛的多语言支持。Tesseract OCR 库支持超过 100 种语言,使其成为需要处理多语言文档的应用程序的理想选择。软件开发者可以指定希望 Tesseract 使用的语言,从而提升非英文文本的识别准确性。下面是一个示例,展示软件开发者如何在 Node.js 应用中识别法语文本?

如何通过 JavaScript API 从图像中识别法语文本?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 中国人