Loading article…
コンピューティングとコンピュータ サイエンスに関するメッセージ理解会議( MUC )は、情報抽出の新しい、より優れた方法の開発を促進するために、 DARPA (国防高等研究計画局) によって開始され、資金提供されました。この競争は、多くの同時並行研究チームが互いに競い合うという特徴があり、評価基準の開発、たとえば精度や再現率などの指標の採用が必要でした。
トピックと演習
最初の会議 (MUC-1) のみ、参加者は抽出された情報の出力形式を選択できました。2 回目の会議からは、参加者のシステムが評価される出力形式が規定されました。トピックごとにフィールドが与えられ、テキストからの情報を入力する必要がありました。一般的なフィールドは、たとえば、原因、エージェント、イベントの時間と場所、結果などです。フィールドの数は会議ごとに増加しました。
第 6 回会議 (MUC-6) では、固有表現と共参照の認識タスクが追加されました。固有表現の場合、テキスト内のすべてのフレーズは、人、場所、組織、時間、または量としてマークされることになります。
処理されたトピックとテキスト ソースは、軍事テーマから民間テーマへの継続的な移行を示しており、これは当時の 情報抽出に対するビジネスの関心の変化を反映しています。
文学
- Ralph Grishman、Beth Sundheim:メッセージ理解会議 - 6: 簡単な歴史。第 16 回国際計算言語学会議 (COLING) の議事録、 I 、コペンハーゲン、1996 年、466–471 ページ。
参照
外部リンク
- MUC-7
- MUC-6
- SAIC情報抽出
