Eurotra は、1978 年から 1992 年まで 欧州委員会によって設立され、資金提供された機械翻訳プロジェクトでした。
歴史
1976年、欧州委員会は、商業的に開発された機械翻訳システムSYSTRANを使い始め、当初開発された言語(ロシア語-英語、英語-フランス語)以外の言語でも機能するようにする計画でしたが、困難であることが判明しました。これと、欧州研究センター内の既存のシステムの潜在能力により、1978年に、最初は準備段階のEurotra調整グループを通じて、Eurotraプロジェクトを開始することが決定されました。4年後、欧州委員会と調整グループは、欧州議会の承認を得ました。[1]
このプロジェクトの目標は、当時の欧州共同体の公用語であるデンマーク語、オランダ語、ドイツ語、英語、フランス語、イタリア語、後にギリシャ語、スペイン語、ポルトガル語も含めた機械翻訳システムを作成することであった。[2]
しかし、時が経つにつれ、期待は薄れていきました。「完全自動高品質翻訳」は、現実的に達成可能な目標ではありませんでした。Eurotra の本質は、プロトタイプの開発ではなく、競争前の研究であることが最終的に認識されました。
このプロジェクトは、EU の創設原則の 1 つである「すべての市民が委員会のあらゆる議事録を自分の言語で読む権利を持つ」という原則に動機づけられました。加盟国が増えるにつれて、関係する言語ペアの数が爆発的に増加し、EU が作成したすべての文書、スピーチ、さらには会議の議事録を他の 8 つの言語に翻訳する必要が生じ、翻訳が急速に行政予算の圧倒的な部分を占めるようになりました。この問題を解決するために、Eurotra が考案されました。
このプロジェクトは、単一の研究チームではなく、加盟国各地にメンバーグループが分散し、国境ではなく言語に基づいて組織され(例えば、ルーヴェンとユトレヒトのグループは緊密に協力し合いました)、事務局がルクセンブルクの欧州委員会に置かれたという点で異例でした。[1]
このプロジェクトの実際の設計は、MT プロジェクトとしては珍しいものでした。SYSTRAN などの古いシステムは、辞書ベースが中心で、語順の並べ替えはほとんどサポートされていませんでした。最近のシステムは、並列コーパスに基づく確率的アプローチを採用することがよくあります。Eurotra は、翻訳するテキストの構成構造に対処し、最初に構文解析を行い、次に 2 番目の解析を行って依存関係構造を生成し、最後に 3 番目の文法による解析を行って、内部で中間表現 (IR) と呼ばれるものを生成します。3 つのモジュールはすべてPrologプログラムとして実装されていたため、原理的には、この構造を別の言語の対応するモジュールに逆順に渡して、他の言語のいずれかの翻訳テキストを生成することができます。ただし、実際には、言語ペアはこのように実装されていませんでした。
最初の「ライブ」翻訳は、1987 年初頭のある週末、Ultrixと C-Prologを実行する4Mb Microvax を丸々使用しました。英語からデンマーク語に翻訳された文章は、「日本はコンピューターを作る」でした。システムが直面した主な問題は、いわゆる「パース フォレスト」の生成でした。これは、特定のフレーズに多数の異なる文法規則を適用できることが多く、数百、数千の (多くの場合は同一の) パース ツリーが生成されます。これにより、大量のコンピューター ストレージが消費され、プロセス全体が不必要に遅くなりました。
Eurotra は「実用的な」 MT システムを提供することはなかったが、このプロジェクトは、特にギリシャ、イタリア、スペイン、ポルトガルといった南半球諸国を中心に、ヨーロッパの加盟国における新興の言語産業に長期にわたる広範囲な影響を及ぼした。Eurotra の技術から派生した商用 MT システムが少なくとも 1 つ存在する (デンマークの学術/商業コンソーシアムによって開発)。
参照
参考文献
- ^ ab Raw, Anthorny; Vandecapella, Bart; Van Eynde, Frank (1988). 「Eurotra: 概要」(PDF) . Interface. Journal of Applied Linguistics : 5–32.
- ^ Maegaard, Bente (1995). 「Eurotra、歴史と結果」。機械翻訳サミット V 議事録(PDF)。ルクセンブルク: ACL。
外部リンク
- ユーロトラ スペイン
- ユーロトラユトレヒト
