OCRFeederはGNOME向けの光学文字認識(OCR)スイートであり、 CuneiForm、GOCR、Ocrad、Tesseractなど、ほぼすべてのコマンドラインOCRエンジンをサポートしています。紙文書をデジタル文書ファイルに変換し、視覚障害のあるユーザーがアクセスできるようにすることができます。
OCRFeederは、GNU一般公衆利用許諾契約書(GPL)バージョン3以降の条件に基づく、無料のオープンソースソフトウェアです。Linuxおよびその他のUnix系オペレーティングシステムで利用可能です。

OCRFeederは、Joaquim Rocha氏[ 3 ]がコンピュータサイエンスの修士論文として始めたもので、彼は後にIgalia SLに採用され、そこで開発を続けました[ 4 ] [ 5 ] 。
最初のバージョンは2009年3月に公開されました。[ 6 ] OCRFeederプロジェクトは当初Google Codeで公開およびホストされ、一時的にGitorious [ 7 ]を使用し、現在はGNOMEインフラストラクチャを使用しています。[ 8 ] 2010年4月5日以降、ソフトウェアパッケージが公式のDebianリポジトリに含まれています。[ 9 ]
2010年7月30日のバージョン0.7では画像前処理機能が追加され、2010年11月8日のバージョン0.7.1ではOCRFeeder内からスキャナにアクセスできるようになりました。
OCRFeeder は、GNOMEヒューマン インターフェイス ガイドラインに準拠したシンプルなグラフィカル ユーザー インターフェイスを備えています。ドキュメント レイアウト分析を実行し、レイアウトを適切な出力形式に転送します。コンテンツ領域を検索し、アウトライン化してコンテンツ タイプ (テキストまたは画像) を推測し、テキスト領域を OCR バックエンドで処理します。ほぼすべてのコマンドライン OCR エンジンをバックエンドとして使用でき、すべての一般的な無料エンジンの自動検出と自動構成機能を備えています。OCR バックエンドは、自動構成、必要なコマンドラインを GUI ダイアログに入力、またはXMLファイルを介して直接構成できます。スキャン画像の後処理 (傾き補正を含む) を実行できます。[ 10 ]すべての認識結果は、目的の出力形式で保存する前に確認および編集できます。セッションを保存および読み込むことができます。このスイートにはスペル チェッカーも含まれています。[ 11 ] OCRFeeder には、OCR エンジンから返される生の OCR 結果を後処理するための組み込みの手順があります。ハイフネーションを削除した場合でも、印刷されたテキスト行に残っている区切りを取り除くことができます。
OCRFeederはGUIツールですが、コマンドラインモード(ocrfeeder-cliとして)でも実行でき、これは自動文書バッチ処理に役立つツールとなる可能性があります。[ 12 ]このモードでは、OCRFeederはデフォルトのOCRエンジンを使用します。これは、アプリケーションの設定でユーザーが設定できます。[ 13 ] [ 14 ]
このプログラムはPythonで記述されており、GTK+ライブラリ ( PyGTKを使用) を使用しています。[ 12 ]これは、他の既存のツールのグラフィカルフロントエンド として機能します。たとえば、実際の文字認識は自身では行わず、システムにインストールされている「OCR エンジン」などの外部プログラムを使用します。バックエンド OCR エンジンとして、 CuneiForm、GOCR、Ocrad、Tesseract を自動的に検出して構成できます。[ 15 ]スキャナはSANEを介してアクセスされます。スキャンした画像のポストプロセスには、コマンドライン ツール「Unpaper」[ 12 ]などが統合されています。PDF ファイルは、バックエンドでGhostscript を使用して処理されます。
OCRFeederはPDFファイルやグラフィックファイルからデータをインポートできます。バージョン0.7.1a以降は、スキャナーデバイスから直接画像を取得する機能をサポートしています。[ 11 ]
結果は、 HTML、OpenDocument、プレーンテキスト[ 16 ] 、またはPDF [ 17 ]ファイル形式で保存できます。hOCRファイル出力も計画されています。[ 3 ]初期フォーマットは プログラム内で直接行うことができます。