Festival Speech Synthesis System は、エジンバラ大学の音声技術研究センター (CSTR) のAlan W. Black、Paul Taylor、Richard Caley [ 1 ]によって開発された汎用多言語音声合成システムです。カーネギーメロン大学やその他の機関からも多大な貢献を受けています。BSDライセンスに類似したフリーソフトウェアライセンスの下で配布されています。
さまざまなAPIを備えた完全なテキスト音声変換システムと、音声合成技術の開発および研究環境を提供します。一般的なカスタマイズと拡張のためにSchemeライクなコマンド インタプリタを備えたC++で記述されています。 [ 2 ]
Festivalは多言語対応を前提に設計されており、英語(イギリス英語とアメリカ英語の発音)、ウェールズ語、スペイン語に対応しています。さらに、カスティーリャ語、チェコ語、フィンランド語、ヒンディー語、イタリア語、マラーティー語、ポーランド語、ロシア語、テルグ語など、その他の言語の音声パッケージも用意されています。
Festvoxプロジェクトは、新しい合成音声の構築をより体系的かつ文書化することを目的としており、[ 3 ]誰でも新しい音声を構築できるようにしています。MITライセンスに似たフリーソフトウェアライセンスの下で配布されています。
Festvoxは、 Alan W. BlackとKevin LenzoがFestival用の合成音声を作成するために作成したツール群です。これには、「合成音声の作成」というドキュメントに例付きのステップバイステップのチュートリアルが含まれています。[ 4 ]
Fliteは、カーネギーメロン大学で開発された小型のランタイム音声合成エンジンで、FestivalとFestvoxの両方から派生したものです。[ 5 ]
GStreamer用のFestivalプラグインがあります。Festival は、いくつかのLinux ディストリビューション向けにパッケージ化されています。