ISO 11940 は、タイ語文字の音訳に関するISO標準であり、1998 年に発行され、2003 年 9 月に更新され、2008 年に承認されました。この標準の拡張であるISO 11940-2では、この標準に基づいた簡略化された転写が定義されています。
子音
純粋子音の音訳は、頭子音としての通常の発音に由来する。無標のh は、有気子音を表す二重音字を形成するために使用される。高低の子音のペアは、高級子音にマクロンを適用することにより、体系的に区別される。同一の音声機能を持つ子音のさらなる区別は、最も頻度の高い子音を無標のままにし、2番目に多い子音の下に点を付け、3番目に多い子音に角を付け、4番目に多い子音に下線を付けることで得られる。下点の使用は、逆屈折子音の下に点を付けて区別するというインドの慣習と同様の効果をもたらすが、微妙な違いがあり、下に点を付けるのは ธtho thongと ศso salaの音訳であり、対応する逆屈折子音の音訳ではない。子音の音訳は、基本文字、マクロン(ある場合)、下の点、角、または「下のマクロン」の順に入力する必要があります。音訳に角が含まれる子音は ฅkho khon、 ฒtho phuthao 、および ษso ruesiの 3 つだけで、下線が付く子音は ฑtho nang montho の1 つだけです。
母音
文字å は、音訳の出力で指定される唯一の合成済み文字です。
Lakkhangyao (ๅ) は、母音文字 ฤ および ฦ との組み合わせでのみ示されています。標準では、子音には ฤ と ฦ が、母音にはlakkhangyao が単にリストされています。単独のlakkhangyaoも、ストローク付きの小文字「i」( ɨ ) で翻字されますが、これはタイ語、パーリ語、サンスクリット語では発生しません。
ว wo waenと อo angの音訳は完全な母音記号として使用されているためここに含まれていますが、その音訳は使用方法に依存せず、標準では単に子音とともにリストされています。
複合母音記号は、その構成要素に応じて音訳されます。
その他の結合記号
yamakkan (–๎) は上付きチルダではなく、スペースチルダで表される ことに注意してください。
句読点と数字
ISO 11940:1998 では、略語記号paiyannoi (ฯ) と文末記号angkhandiao (ฯ) を区別していますが、国別文字規格TIS 620-2533もUnicodeバージョン 5.0 もこれらを区別していません。 Paiyannoiはǂと翻字され、angkhandiaoはǀと翻字されます。paiyannoi、angkhandiao、angkhankhu (๚) は、二重ダガー、縦棒、またはダンダではなく、クリック子音に使用される文字で翻字されることに注意してください。
文字の順序付け
一般に、文字は左から右へ、また、文字の水平位置が同じ場合は上から下に翻字されます。垂直方向の順序は、実際には、声調記号とthanthakhat (–์) が子音の上または下の他の記号の前に付くことで単純に指定されます。規格では、セクション 4.2 の最後で、sara u (◌ุ, ◌ู) とnikkhahit (◌ํ) の組み合わせが発生する可能性を否定し、次にnikkhahitの翻字を指定する際にその例を示していますが、組み合わせの翻字は示していません。これらの規則の結果、nikkhahitを除き、タイ語で子音に付加されるすべての非母音記号は、ローマ字翻字でも子音に付加されます。
この規格では、前置母音と子音の転置を試みることはローマ字に慣れている人にとっては安心できるかもしれないと認めていますが、前置母音を転置しないことを推奨しています。
たとえば、ภาษาไทย ( RTGS : Phasa Thai ) はp̣hās̛̄āịthyに、เชียงใหม่ ( RTGS : Chiang Mai ) はechīyngıh̄m̀に音訳する必要があります。
バリエーション
原因
標準ではアクセントを入力する順序が指定されていますが、すべての入力システムで入力順にアクセントが記録されるわけではありません。Unicode では複数のアクセントを持つ文字に対して 2 つの正規化形式が指定されており、翻字されたテキストはこれらの形式のいずれかで保存される可能性が高くなります。これにより、自動逆翻字が複雑になります。Unicode 準拠のプロセスではこのようなバリエーションを正しく処理する必要があるため、このページの翻字は表示しやすいように選択されています。現在のレンダリング システムでは同等の形式が異なって表示される可能性があります。
多くのフォントでは、子音とアクセントの斬新な組み合わせがうまく表示されません。たとえば、エストニア語研究所は、標準をタイ語に適用する説明をWeb 上で公開していますが、1 つの例外を除いて、これは標準に準拠しているようです。例外は、マクロンを除いて、子音の上のアクセントが実際には右にオフセットされているため、対応する非結合文字として入力された印象を与えることです。標準ではコード ポイントでの音訳を指定していますが、この無料の説明から作業する人は、声調アクセントの間隔形式を使用する必要があると簡単に推測できます。
ICU (CLDR 1.4.1)
Unicodeが後援する共通ロケールデータリポジトリのバージョン1.4.1に記録されているICUの実装[ 1 ]では、子音の音訳にホーンではなくプライムが使用されています。これは、ฅkho khon、ฒtho phuthao、ษso bo ruesiの音訳に影響します。ฏto patakもṭではなくt̩と異なる音訳になっています。
この実装では、 仮想のタイ文字シーケンス ะํ ( sara a、nikkhahit ) との曖昧さを回避するために、 ำ をåではなくảとして翻字します。ICU 実装では、Unicode正規化の問題を回避するために、 ฺ phinthu をではなくˌとして翻字します。これは、点線の下の子音に適用すると読みやすさが向上するという副作用があります。
ICU 実装では、ฯpaiyannoi を‡ (二重の短剣)に、 angkhankhu を|| (2 つの ASCII 縦棒)に翻字します。ICU 実装では Unicode が使用されるため、意味解析を行わずにangkhandiaoとpaiyannoiを確実に区別することはできず、そのような試みも行われません。
ICU 実装の文字シーケンスは異なります。前置母音を次の子音と置き換え、子音のマークをメモリに格納されている順序で処理します (ほとんどのタイ語入力方法では、マークが下から上の順序で格納されることが保証されます)。子音クラスターが完全に揃った前置母音は置き換えません。子音クラスターは完全に正確に識別できず、クラスターを含む母音を置き換えるには、タイ文字への確実な変換を可能にする追加の記号が必要になります。
たとえば、この実装では、ภาษาไทย はp̣hās̄ʹāthịyに音訳され、เชียงใหม่ はcheīyngh̄ım̀に音訳されます。
最後に、この実装はUnicode 正規化形式 C (NFC) で翻字を生成します。
参照
参考文献
- ^ http://unicode.org/Public/cldr/1.4.1/core.zip ファイル transforms/ThaiLogical-Latin.xml および transforms/Thai-ThaiLogical.xml (ICU の「Thai-Latin」および「Latin-Thai」の音訳で使用)
外部リンク
- 公式サイト
- Unicode.org の音訳規則[永久リンク切れ ]
- エストニア語研究所のKNABデータベースにおけるタイ語地名のローマ字表記
