LanguageWareは、 IBMが開発した自然言語処理(NLP)技術であり、アプリケーションが自然言語テキストを処理できるようにします。これは、言語識別、テキスト分割/トークン化、正規化、エンティティおよび関係抽出、意味解析および曖昧性解消といった、さまざまなNLP機能を提供するJavaライブラリ群で構成されています。解析エンジンは、複数のレベルで有限状態機械アプローチを採用しており、これによりパフォーマンス特性が向上しつつ、比較的小さなフットプリントを維持しています。
システムの動作は、処理対象言語の特性とドメインを記述する、設定可能な語彙意味論的リソースのセットによって制御されます。LanguageWareにはデフォルトのリソースセットが付属しており、これらは形態論などの母語の特性と、その言語の基本語彙を記述します。追加の語彙、用語、規則、文法を網羅する補足リソースも作成されており、これらは言語全体に共通するものもあれば、1つ以上のドメインに固有のものもあります。
IBMのalphaWorks [ 1 ]サイトでは、 EclipseベースのカスタマイズツールセットであるLanguageWare Resource Workbenchが利用可能で、ドメイン知識をこれらのリソースにコンパイルして分析プロセスに組み込むことができます。
LanguageWareは、 UIMA準拠のアノテーター、Eclipseプラグイン、またはWebサービスとして展開できます。
参考文献
- ↑ 「alphaWorksコミュニティ」 . alphaworks.ibm.com. 2009年10月20日。
外部リンク
- IBM LanguageWare Resource Workbench on alphaWorks
- IBM LanguageWare Miner for Multidimensional Socio-Semantic Networks on alphaWorks
- IBM.com の IBM LanguageWare 用 JumpStart インフォセンター
- Apache Software FoundationのUIMAホームページ
- SourceForge上のUIMAフレームワーク
- IBM OmniFind Yahoo! Edition(無料の企業向け検索エンジン)は、2007年2月17日にWayback Machineにアーカイブされました。
- セマンティック情報システムおよび言語工学グループ
- SemanticDesktop.org
- Branimir K. Boguraev「大規模NLPアーキテクチャにおける注釈に基づく有限状態処理」、IBMリサーチレポート、2004年
- Alexander Troussov、Mikhail Sogrin、「IBM LanguageWare オントロジーネットワークマイナー」
- Sheila Kinsella、Andreas Harth、Alexander Troussov、Mikhail Sogrin、John Judge、Conor Hayes、John G. Breslin、「意味的に有効な人物および関連オブジェクトのネットワークのナビゲーションと注釈付け」
- ミハイル・コテルニコフ、アレクサンダー・ポロンスキー、マルテ・キーゼル、マックス・フェルケル、ハイコ・ハラー、ミハイル・ソグリン、パー・ランネロ、ブライアン・デイヴィス、「インタラクティブ・セマンティック・ウィキ」
- Sebastian Trug、Jos van den Oever、Stéphane Laurière、「ソーシャル セマンティック デスクトップ: Nepomuk」
- シーマス・ローレス、ヴィンセント・ウェイド、「動的コンテンツの発見、収集、配信」
- R. Mack、S. Mukherjea、A. Soffer、N. Uramoto、E. Brown、A. Coden、J. Cooper、A. Inokuchi、B. Iyer、Y. Mass、H. Matsuzawa、およびLV Subramaniam、「非構造化情報管理アーキテクチャを用いたライフサイエンスのためのテキスト分析」
- Alex Nevidomsky、「IBMにおけるUIMAフレームワークと知識発見」、第4回テキストマイニングシンポジウム、フラウンホーファーSCAI、2006年