拡張音声評価方法音声アルファベット(X-SAMPA )は、ユニバーシティ・カレッジ・ロンドンの音声学教授であるジョン・C・ウェルズによって1995年に開発されたSAMPAの変種です。[ 1 ]これは、各言語のSAMPAアルファベットを統一し、SAMPAを拡張して1993年版の国際音声アルファベット(IPA)の全範囲の文字をカバーするように設計されています。その結果、SAMPAに触発されたIPAの7ビットASCIIへの再マッピングが実現しました。
X-SAMPAは、テキストエンコーディングではIPA記号を表現できないという問題を回避するための暫定的な方法として考案されました。その後、 UnicodeによるIPA記号のサポートが普及するにつれ、IPAをASCIIで表現するためのコンピュータ読み取り可能な別システムの必要性は低下しました。しかし、X-SAMPAはIPAの入力方法の基盤として依然として有用です。
SAMPAは、音声学および音声技術における転写の電子メールデータ交換とコンピュータ処理を容易にするために、1980年代後半に欧州委員会が資金提供したESPRITプロジェクト2589「音声評価方法」(SAM)で開発されました。そのため「SAM音声記号」とも呼ばれています。可能な限り多くの記号がIPAから引き継がれましたが、それが不可能な場合は、利用可能な他の記号が使用されました。例えば、シュワー(IPA [ə] )には[ @] 、[ø] (フランス語のdeux ( 「2 」 )の母音)には[ ]、 [œ] (フランス語のneuf ( 「9 」 )の母音)には[ ]が使用されています。29
SAMPAは、当初標準化された時点では、IPAの部分的な符号化方式でした。SAMPAの最初のバージョンは、デンマーク語、オランダ語、英語、フランス語、ドイツ語、イタリア語の音素コードセットを統合したもので、後のバージョンでは他のヨーロッパ言語にも対応できるよう拡張されました。SAMPAは音素目録に基づいているため、各SAMPAテーブルは作成された言語でのみ有効です。このIPA符号化方式を普遍的に適用できるようにするため、言語固有の差異のない単一のテーブルを提供するX-SAMPAが開発されました。
以下の言語の音に対応する、言語固有のSAMPA表現が開発されています。
X-SAMPAは、IPA表記に以下のASCII表記を使用します。
sは とは異なる音ですが、音韻的には多くの点で関連しています。このようなバックスラッシュ文字の使用は、多くのプログラムがそれを後続の文字のエスケープ文字s\として解釈するため、問題となる場合があります。たとえば、このような X-SAMPA 記号はEMUでは機能しないため、EMU 音声データベースに音素転写を追加する際には、バックスラッシュを別の記号 (たとえば、アスタリスク: '*') に置き換える必要があります。バックスラッシュには決まった意味はありません。~、(鼻音化)、=(音節性)、`(そり舌音化およびr音化)については、アンダースコアは省略可能です。k_pのコードです。_1です。_6fonxsampレジストリは、X-SAMPAで転写されたテキストのサブタグとして割り当てました。 [ 3 ]SAM PROSodic Alphabet (SAMPROSA )は、 SAM Prosody Working Group の一員としてDafydd Gibbon、Daniel J. Hirst、William J. Barryによって開発された韻律転写システムです。 [ 4 ] [ 5 ] [ 1 ] SAMPROSA は、SAMPA の韻律記号とSAM System for Intonation Transcription (SAMSINT) で構成されています。[ 5 ]ただし、SAMPA の分節記号と SAMPROSA の韻律記号には多少の重複があるため、X-SAMPA では、およびtier エスケープ記号を使用して SAMPROSA 表記を SAMPA から分離しています。IPA の代替的なトーン (ȅ、e̋ など) のエンコード方法も、同じ SAMPROSA 表記システムから派生しています。B、L、M、H、T、R、F を の後に使用します。<>_
上記のような声調文字は、Unicodeでは合字としてレンダリングされる修飾文字を組み合わせることで表現されます。例えば、˧˥(<HT>)は、˧(<H>)と˥(<T>)がスペースを挟まずに隣接して配置された形で表されます。言語固有の声調番号(<1>、など)が、明示的な対応物(例: 、 )<2>の代わりに使われることもありますが、このような言語間の使用方法はX-SAMPAの一部として標準化されていません。<TT><M>