SAMPA(音声評価法音声記号)は、国際音声記号(IPA)に基づいた、 7ビットの印刷可能なASCII文字を使用したコンピュータ可読な音声文字です。1980年代後半に、 EEC ESPRIT情報技術研究開発プログラムによって、6つのヨーロッパ言語用に開発されました。可能な限り多くの記号がIPAから引き継がれましたが、それが不可能な場合は、使用可能な他の記号が使用されています。たとえば、シュワー(IPA [ə])には[ ] 、フランス語のdeux 「2」の母音(IPA [ø])には[ ]、フランス語のneuf「9」の母音(IPA [œ])には[ ]です。
@2 9
現在、SAMPA は公式に、以下の言語のすべての音に対して開発されています。
[ ] という文字は"s{mp@、SAMPA という英語の発音を表し、最初の記号 ["] は主要なストレスを示します。IPA と同様に、SAMPA は通常、角括弧またはスラッシュで囲まれますが、これらはアルファベットの一部ではなく、通常のテキストではなく音声であることを示すだけです。
特徴
SAMPA は、電子メールのデータ交換と音声学および音声技術における転写の計算処理を容易にするために、欧州委員会が資金提供したESPRITプロジェクト 2589「音声評価方法」(SAM) (したがって「SAM 音声アルファベット」) で 1980 年代後半に開発されました。
SAMPA はIPAの部分的なエンコードです。SAMPA の最初のバージョンは、デンマーク語、オランダ語、英語、フランス語、ドイツ語、イタリア語の音素コード セットの統合でした。その後のバージョンでは、SAMPA が拡張され、他のヨーロッパ言語もカバーするようになりました。SAMPA は音素インベントリに基づいているため、各 SAMPA テーブルは、そのテーブルが作成された言語でのみ有効です。このIPAエンコード手法を普遍的に適用できるようにするために、言語固有の違いのない単一のテーブルを提供するX-SAMPAが作成されました。
SAMPA は、テキストエンコーディングがIPA 記号を表現できないという問題を回避するためのハックとして考案されました。その結果、IPA 記号のUnicodeサポートが普及するにつれて、ASCII で IPA を表現するための別のコンピューター可読システムの必要性は減少します。ただし、テキスト入力は特定のキーボードエンコーディングまたは入力デバイスに依存します。このため、SAMPA と X-SAMPA は、計算音声学と音声技術の分野で 今でも広く使用されています[1] [より適切な情報源が必要] 。
参照
- 国際音声記号のASCIIエンコードの比較
- SAMPAチャート
- 英語版SAMPAチャート、簡潔版
- X-SAMPA はSAMPAに似た言語に依存しない表記法だが、IPAレパートリー全体をカバーしている。
- BABEL音声コーパス
参考文献
- ^ 「Project Euphonia の非標準音声向けパーソナライズ音声認識」。Google AI ブログ。2019 年 8 月 16 日閲覧。
- Ranchhod, Elisabeth & J. Mamede, Nuno (2002).自然言語処理の進歩: 第 3 回国際会議、PorTAL 2002、ポルトガル、ファロ、2002 年 6 月 23 ~ 26 日。議事録 (コンピュータサイエンスの講義ノート)。(第 1 版)。Springer。ISBN 3-540-43829-7。
- L. DeMiller, Anna & Rettig, James (2000)。『言語学:参考文献ガイド(第2版)』。Libraries Unlimited。ISBN 1-56308-619-0。
- ランバート、コーエン、ゴールドストーン、ロブ(2004)。認知ハンドブック。セージ出版。ISBN 0-7619-7277-3。
外部リンク
- SAMPA コンピュータ可読音声アルファベット
- SAMPA における英語の音素表記
- SAMPA for Scots 2003-08-11 にWayback Machineでアーカイブ
- (ドイツ語)テキストからSAMPAおよびIPAへのコンバータ(Ajaxアプリケーション)
- IPA-SAMPA コンバーターと IPA-SAMPA チャート
