ヒンドゥスターニー語(標準化ヒンディー語と標準化ウルドゥー語)は、いくつかの異なる文字で書かれてきました。ヒンディー語のテキストのほとんどは、古代インドのブラーフミー文字に由来するデーヴァナーガリー文字で書かれています。ウルドゥー語のテキストのほとんどは、ペルシャ文字に由来するウルドゥー語アルファベットで書かれています。ヒンドゥスターニー語は、両方の文字で書かれてきました。近年では、技術的または国際化上の理由から、これらの言語ではラテン文字が使用されています。歴史的には、カイティ文字も使用されていました。
デーヴァナーガリー文字
デーヴァナーガリー文字はアブギダであり、書かれた子音には固有の母音があり、標準ヒンディー語ではシュワーである。単語の末尾など特定の文脈では母音がなく、シュワーシンコペと呼ばれる現象が発生する。[1]その他の母音は子音文字に分音記号を付けて書かれる。デーヴァナーガリー文字は左から右に書かれ、文字は上部のバーによってつながれる。
母音
子音
非ネイティブ音素の修正子音
不規則な合字:
- क्ष (क と ष) kṣは/kʂ/または/x/と発音されます(ウィクショナリー:क्ष) (不規則な形、規則的な発音)
- त्र (त と र) tr は/t̪ɾ/と発音されます(wiktionary:त्र) (不規則な形、規則的な発音)
- ज्ञ (ज と ञ) jñ は/ɡj/と発音されます(wiktionary:ज्ञ) (不規則な形と発音)
シュワー削除
デーヴァナーガリー文字の各子音に暗黙的に含まれるシュワー(अ または 'ə'、時には 'a' と書かれる)は、ヒンディー語では単語の末尾や他の特定の文脈で「必須に削除」される。[2]この現象は、ヒンディー語の「シュワー失音規則」または「シュワー削除規則」と呼ばれている。 [1] [2]この規則の1つの形式化は、ə -> ø | VC_CVと要約されている。言い換えれば、母音先行子音の後に母音後続子音が続く場合、最初の子音に固有のシュワーが削除される。[1] [3]しかし、この形式化は不正確かつ不完全(つまり、削除すべきでないシュワーを削除したり、削除すべきときに削除しなかったりする)であり、エラーを引き起こす可能性がある。シュワー音の削除は、ヒンディー語の音声合成ソフトウェアの構築に不可欠であるため、計算上重要である。[3] [4]
シュワー失調の結果、多くの単語の正しいヒンディー語の発音は、デーヴァナーガリー語の文字通りの発音とは異なっています。例えば、राम はRām(誤り:Rāma)、रचना はRachnā(誤り:Rachanā)、वेद はVéd(誤り:Véda)、नमकीन はNamkeen(誤り:Namakeena)です。[3] [4]
ペルシア文字
ウルドゥー語のアルファベットは、アラビア文字であるペルシャ語に基づいています。ウルドゥー語は右から左に書かれ、ほとんどの文字はつながっています。そのため、単語内の位置に応じて文字の形が異なります。ほとんどの母音は一般的なテキストでは省略されますが、曖昧さ回避や教育目的で省略される場合があります。ウルドゥー語は主にナスタリクと呼ばれる書道の書体で書かれます。
ラテン文字
技術上または国際化上の理由から、ヒンドゥスターニー語の表記にはラテン文字が使用されてきました。ローマ字ヒンディー語とローマ字ウルドゥー語では、基本的なラテン文字が使用されています。これは、チャット、電子メール、SMSなどの技術アプリケーションで、若いネイティブスピーカーによって最も一般的に使用されています。
ITRANS、ISCII、IAST(およびほぼ同一のISO 15919)、およびハーバード-京都のローマ字表記法は、主にラテンアルファベットに慣れている非ネイティブスピーカー向けに採用されてきました。
音訳
3つの文字間の翻字は複雑になる可能性があり、特にデーヴァナーガリー文字とペルシア文字間の翻字は複雑です。[6]これの障害の1つは、1つの文字の複数の異なる文字が、他の文字ではすべて同じ文字に対応することが多いことです。[6]そのため、単純な置換では正しいスペルが生成されないことがよくあります。
似た音を持つウルドゥー語の文字
ウルドゥー語の文字セットの中には、一致する音を持つものもあります。[6] [7]
- 4文字زذضظはすべて≈Zである[6] [7]
- 3文字سصثはすべて≈Sである[6] [7]
- 2つの文字تطは両方とも≈Tです[6] [7](3番目の文字ٹも英語のTとして示されることが多いが、他の2つのウルドゥー語の文字とは異なります。下記の#逆屈折子音を参照してください。)
- 2つの文字ہحはどちらも≈Hである[7]が、異なる文字として扱われることもある。
点字
点字アルファベットは 3 つ使用されています。 インドのヒンディー語とウルドゥー語の点字は、バーラティ点字の慣例に基づいており、パキスタンのウルドゥー語の点字は、ペルシャ点字の慣例に基づいています。ヒンディー語の点字は、一部の環境では書かれないアルファベットですが、パキスタンのウルドゥー語の点字では、印刷されているので母音はオプションであるようです。
参照
参考文献
- ^ abc Tej K. Bhatia (1987)、ヒンディー語文法伝統の歴史: ヒンディー語・ヒンドゥスターニー語の文法、文法学者、歴史と問題、BRILL、ISBN 90-04-07924-6、
...ヒンディー語の文献はデーヴァナーガリー文字で書かれているため、実際の発音の信頼できる指標としては機能しません...ヒンディー語で機能するシュワー失神の規則...
- ^ ab ラリー・M・ハイマン、ビクトリア・フロムキン、チャールズ・N・リー(1988年)、言語、話し言葉、心、第2巻、1988年、第2部、テイラー&フランシス、ISBN 0-415-00311-3、
... 暗黙の /a/ は、記号が単語の末尾に現れる場合や、(ヒンディー語の単語音韻論で重要な役割を果たす、いわゆるシュワー削除規則により)それが必須的に削除される特定の他の文脈では読み取られません...
- ^ abc Monojit Choudhury、Anupam Basu、Sudeshna Sarkar (2004 年 7 月)、「インド・アーリア語におけるシュワー音節の通時的アプローチ」(PDF)、計算音韻論に関する ACL 特別興味グループ (SIGPHON) ワークショップの議事録、計算言語学協会、
... シュワー音節の削除は、IAL の書記素から音素への変換において重要な問題であり、これは優れた音声合成装置に必要です...
- ^ ab Naim R. Tyson; Ila Nagar (2009)、「ヒンディー語のテキスト音声合成におけるシュワー削除の韻律規則」、International Journal of Speech Technology、12 : 15– 25、doi :10.1007/s10772-009-9040-x、
... シュワーを適切に削除しないと、音声出力は不自然に聞こえます。デーヴァナーガリーの正書法表現では削除箇所がほとんど示されないため、ヒンディー語の最新の TTS システムでは、シュワーが出現する分節コンテキストに基づいてシュワー削除規則を実装しています...
- ^ 「ウルドゥー語音声目録」(PDF)www.cle.org.pk。言語工学センター。 2020年5月19日閲覧。
- ^ abcdef Jawaid, Bushra; Ahmed, Tafseer (2009). 「ヒンディー語からウルドゥー語への変換: 単純な音訳を超えて」(PDF)。2009年言語とテクノロジーに関する会議の議事録。 2020年5月19日閲覧。
- ^ abcde Bhatia, Tej K.; Khoul, Ashok; Koul, Ashok (2015年8月27日). 「Colloquial Urdu: The Complete Course for Beginners」. Routledge . 2020年5月19日閲覧。
