1. 製品
  2.   OCR
  3.   JavaScript
  4.   Node-Tesseract-OCR
 
  

JSプロジェクトにOCR機能を追加する無料のNode.js API。

オープンソースのNode.js OCRライブラリで、プログラマーが画像(JPEG、PNG)、PDF、ドキュメントなどさまざまなファイル形式からテキストを無料で認識・抽出でき、多言語に対応しています。

Node-Tesseract-OCRとは何ですか?

今日のデジタル時代において、画像や文書からテキストを抽出することは、文書管理、データ処理、人工知能などさまざまな業界で重要なタスクとなっています。光学文字認識(OCR)技術により、スキャンした文書、画像、PDF を編集可能なテキスト形式に変換できるようになりました。Node-Tesseract-OCR は、Tesseract OCR エンジンのパワーを取り入れたオープンソース API で、Node.js アプリケーションで OCR タスクをシームレスかつ効率的に実行する方法を提供します。

Node-Tesseract-OCR は、Tesseract OCR エンジンの Node.js ラッパーであり、ソフトウェア開発者が Node.js 環境内で Tesseract の強力な文字認識機能を利用できるようにします。API はこの GitHub リポジトリで管理されており、シンプルなテキスト抽出からより複雑な文書処理タスクまで、さまざまなユースケースに適した機能を提供します。ソフトウェア開発者は、画像や文書から複数言語のテキストを抽出でき、さまざまなアプリケーションで汎用性の高いツールとなります。

Node-Tesseract-OCR APIは、画像フィルタリング、リサイズ、クロッピングなどの高度な画像処理機能を提供し、抽出されたテキストの正確性と信頼性を確保します。100以上の言語をサポートしており、多様な環境でのOCRタスクに対応できる汎用的なソリューションです。ソフトウェア開発者は画像、PDF、ドキュメントからテキストを抽出し、JSON、XML、プレーンテキストなど様々な形式で抽出結果を返すことができます。軽量で柔軟かつ使いやすいよう設計されており、プロジェクトにOCR機能を追加したい開発者に最適な選択肢です。高度な画像処理機能、言語サポート、エラーハンドリング機構を備えているため、OCR機能をプロジェクトに組み込みたい開発者にとって理想的な選択肢です。

Previous Next

Node-Tesseract-OCRの入門

Node-Tesseract-OCRをインストールする推奨方法はnpmを使用することです。スムーズなインストールのために以下のコマンドをご利用ください。

npmでNode-Tesseract-OCRをインストール

npm install node-tesseract-ocr 

手動でインストールすることもできます。最新のリリースファイルを GitHub リポジトリから直接ダウンロードしてください。

Node.js API における画像からのテキスト抽出

オープンソースの Node-Tesseract-OCR ライブラリは、ソフトウェア開発者が Node.js アプリケーション内で画像からテキストを自動的に抽出するアプリケーションを簡単に作成できるようにします。スキャンした文書、PDF、カメラで撮影した写真、領収書の写真からのテキスト抽出をサポートしています。これにより、検索可能なアーカイブの作成、データ入力の自動化、金融や医療などの分野で大量の文書を処理することが有用です。以下は、Node.js アプリケーション内で画像からテキストをプログラム的に抽出する方法を示す簡単な例です。

Node.js 環境で画像からテキストを抽出する方法は?

const tesseract = require("node-tesseract-ocr");

tesseract.recognize("path/to/image.jpg")
  .then(text => {
    console.log("Recognized Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

Node.js 内での画像前処理の改善

OCR を適用する前に画像を前処理することで、文字認識の精度を大幅に向上させることができます。オープンソースの Node-Tesseract-OCR ライブラリは、リサイズ、二値化、傾き補正などの基本的な前処理手法を提供します。これらの前処理ステップは、sharp や jimp といった追加の Node.js ライブラリと組み合わせて Node-Tesseract-OCR と共に実装できます。以下の例は、特に低品質の画像に対して、ソフトウェア開発者が前処理ステップを使用して認識精度を向上させる方法を示しています。

Node.js API を使用して認識精度を向上させるための前処理手順の適用方法は?

const sharp = require("sharp");
const tesseract = require("node-tesseract-ocr");

sharp("path/to/input.jpg")
  .resize(800, 600) // Resize the image
  .greyscale() // Convert to greyscale
  .toBuffer()
  .then(data => {
    return tesseract.recognize(data, { lang: "eng" });
  })
  .then(text => {
    console.log("Preprocessed Image Text:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

多言語で認識されたテキスト

Node-Tesseract-OCR の際立った特徴のひとつは、豊富な多言語サポートです。Tesseract OCR ライブラリは 100 以上の言語をサポートしており、さまざまな言語の文書を処理する必要があるアプリケーションに最適な選択肢となります。ソフトウェア開発者は Tesseract に使用させたい言語を指定でき、英語以外のテキストの認識精度を向上させることができます。以下は、ソフトウェア開発者が Node.js アプリケーション内でフランス語のテキストを認識できる例ですか?

JavaScript API を介してフランス語の画像からテキストを認識する方法は?

const config = {
  lang: "fra", // French language support
  oem: 1,
  psm: 3
};

tesseract.recognize("path/to/french-text-image.jpg", config)
  .then(text => {
    console.log("Recognized Text in French:", text);
  })
  .catch(error => {
    console.error("Error:", error.message);
  });

 日本