| 原作者 | ティエリー・デュトワ |
|---|---|
| 開発者 | ヴィンセント・パジェル |
| 初回リリース | 1995年 |
| 安定版リリース | 3.3 / 2019年12月17日 |
| リポジトリ | github.com/numediart/MBROLA |
| 書かれた | C |
| オペレーティング·システム | Linux Windows FreeBSD |
| タイプ | 音声合成装置 |
| ライセンス | GNU アフェロ一般公衆利用許諾書 |
| Webサイト | github.com/numediart/MBROLA |
MBROLAは世界規模の共同プロジェクトである音声合成 ソフトウェアです。MBROLAプロジェクトのWebページには、多くの[1]話し言葉の二音節データベースが掲載されています。
MBROLA ソフトウェアは、これらすべての言語に対応する完全な音声合成システムではありません。まずテキストをMBROLA の形式の音素と韻律情報に変換する必要があり、別のソフトウェア (例: eSpeakNG ) が必要です。
歴史
MBROLA プロジェクトは、1995 年にモンス工科大学(ベルギー)の TCTS ラボで、できるだけ多くの言語に対応した音声合成装置を開発するための科学プロジェクトとして開始されました。MBROLA ソフトウェアの最初のリリースは 1996 年で、非商用、非軍事用途のフリーウェアとして提供されました。作成された音声データベースのライセンスはそれぞれ異なりますが、ほとんどが非商用、非軍事用途向けです。
非商用アプリケーションにのみ無料で使用できるため、MBROLAはLinuxワークステーションの事実上の音声合成エンジンeSpeakNGの代替として個人/家庭ユーザー向けに提供されていましたが、商用ソリューション(音声によるタイムクロック、港やターミナルへの搭乗通知など)にはほとんど使用されていませんでした。音声データベースの初期開発後、MBROLAソフトウェアの更新とサポートは停止し、クローズドソースのバイナリは徐々に最新のハードウェアやオペレーティングシステムの開発に遅れをとるようになりました。[2]これに対処するため、MBROLA開発チームはMBROLAをオープンソースソフトウェアとしてリリースすることを決定し、2018年10月24日にソースコードがGNU Affero General Public LicenseでGitHubにリリースされました。2019年1月23日には、同じライセンスで WAVファイルからMBROLAデータベースを作成できるMBROLATORというツールがリリースされました。
使用される技術
MBROLAソフトウェアは、音声生成にMBROLA(Multi-Band Resynthesis OverLap Add)[3] アルゴリズムを使用しています。これはdiphoneベースですが、一定のピッチと倍音位相を適用してdiphoneを前処理することで、セグメントの品質をわずかに低下させるだけで連結性を高めるため、MBROLAの合成品質はほとんどのdiphone合成装置よりも高いと考えられています。
MBROLA はPSOLAに似た時間領域アルゴリズムで、合成時の計算負荷が非常に低くなります。ただし、PSOLA とは異なり、MBROLA ではピッチ周期の事前マーキングが必要ありません。この機能により、MBROLA アルゴリズムを中心に MBROLA プロジェクトを開発することが可能になり、世界中の多くの音声研究室、企業、個人が、多くの言語や音声の二音データベースを提供してきました。
参考文献
- ^ MBROLA の音声一覧
- ^ Mbrola-64 は SEGFAULT ですぐにクラッシュします
- ^ Dutoit, T; Leich, H (1993 年 12 月). 「MBR-PSOLA: セグメント データベースの MBE 再合成に基づくテキスト音声合成」.音声通信. 13 (3–4): 435–440. doi :10.1016/0167-6393(93)90042-J.
- MBROLA ソースコードリポジトリ
- MBROLAでフェスティバルを利用する
外部リンク
- MBROLA 音声 (MBROLA 音声合成装置用データベース)
- MBROLATOR(MBROLA音声合成装置用データベース作成ツール)
