GOCR(またはJOCR)は、 Jörg Schulenburgによって最初に作成された無料の光学文字認識プログラムです。画像ファイル(ポータブルピクスマップまたはPCX)をテキストファイルに変換またはスキャンするために使用できます。[ 1 ]
GOCRは、高さ20~60ピクセルの単一列のサンセリフフォントを処理できると主張している。セリフフォント、重なり合う文字、手書き文字、異種フォント、ノイズの多い画像、大きな傾斜角、ラテン文字以外の文字では問題が発生すると報告している。[ 2 ]
GOCRはバーコードの翻訳もできる。[ 2 ]
GOCR は、スタンドアロンのコマンドラインアプリケーションとして、または他のプログラムのバックエンドとして使用できます。gocr.tclグラフィックインターフェースが付属しています。GOCR は、 OCRFeederの OCR エンジンとしても使用できます。[ 3 ]
バージョン0.3.0は2000年12月に、0.3.5は2002年2月に、0.37は2002年8月にリリースされました。
バージョン0.40(2005年3月)から0.43(2006年12月)にかけて、認識エンジンは徐々にベクターバージョンに置き換えられました。
バージョン0.48は2009年8月にリリースされました。[ 1 ]
バージョン0.49は2010年9月にリリースされました。[ 1 ]
バージョン0.50は2013年3月にリリースされました。[ 1 ]
バージョン0.51は2017年8月にリリースされました。[ 4 ]
このアプリケーションは当初、GNU Optical Character Recognition の略である GOCR という名前でした。SourceForge にプロジェクトを登録する段階になったとき、GOCRという名前は既に使われていたため、プロジェクトは JOCR (Jörg's Optical Character Recognition) として登録されました。[ 1 ] [ 2 ]
この状況の結果、プロジェクトとアプリケーションはGOCRとJOCRの両方で知られています。シュレンバーグはこれが問題であることを認めています。[ 1 ]
許容される画像フォーマットは次のとおりです。[ 2 ]
その他の形式は、 unix パイプを使用してnetpbm-progs、 gzip、bzip2を使用して自動的に変換されます。これらのイメージの種類は次のとおりです。 [ 2 ]