デーヴァナーガリー文字の翻字とは、古典サンスクリット語や他の多くのインド系言語で使用されるインド系文字であるデーヴァナーガリー文字で書かれたテキストを、発音と綴りの規則を保持したままラテン文字で表すプロセスです。デーヴァナーガリー文字からラテン文字への翻字(つまりローマ字化)には、IAST表記法など、いくつかの方法があります。[ 1 ]ローマ字化されたデーヴァナーガリー文字は、ローマナーガリー文字とも呼ばれます。[ 2 ]
国際サンスクリット文字翻字アルファベット(IAST)は、 ISO 15919規格のサブセットであり、サンスクリット語、プラークリット語、パーリ語をローマ字にダイアクリティカルマーク付きで翻字するために使用されます。IASTは広く使用されている規格です。ダイアクリティカルマークを使用して、音韻的に似ているが同一ではないサンスクリット語のグリフを区別します。たとえば、歯音とそり舌音は下点によって区別されます。歯音 द=d、そり舌音 ड=ḍ。IAST の重要な特徴は、可逆性が失われないことです。つまり、IAST 翻字は、正しいデーヴァナーガリー文字や他の南アジアの文字に曖昧さなく変換できます(ただし、ドラヴィダ語で使用される文字は、長母音と短母音を区別する必要があるため除きます)。多くの Unicode フォントは、IAST の表示と印刷を完全にサポートしています。
ローマ字は長い間、インド諸語の標準的な音訳体系の基礎となっており、 JR FirthやSK Chatterjiなどの言語学者によってさまざまな理由で一般的に使用されるよう提唱されてきたが、真剣に使用されたのはコンカニ語のみである。[ 3 ]
ハンテリアン方式は「インドにおける国家的なローマ字表記法」であり、インド政府によって公式に採用されているものである。[ 4 ] [ 5 ] [ 6 ]
ハンテリアン方式は、19世紀に当時のインド測量総監であったウィリアム・ウィルソン・ハンターによって開発されました。 [ 7 ]この方式が提案されたとき、それまで行われていた体系的ではなく、しばしば歪曲された音声転写の「サー・ロジャー・ダウラー方式」(シラージ・ウッダウラの初期の訛り)の支持者からすぐに反対を受けました。この反対は、1872年5月28日のインド評議会での劇的な対決で最高潮に達し、新しいハンテリアン方式が勝利しました。ハンテリアン方式は、文字の音訳を体系化していたため、本質的に単純で、いくつかのインド文字に拡張可能であり、政府と学術界で受け入れられるようになりました。[ 7 ]文字転写モデルの反対者たちは、世紀末まで政府の方針を覆そうと試み続けたが、いずれも失敗に終わった。ある批評家は「インド政府に対し、科学的(つまりハンテリアン式)転写の試みを全て放棄し、古い音声綴りに戻ることをきっぱりと決定するよう」訴えた。[ 8 ]
時が経つにつれ、ハンテリアン方式はビルマ語やチベット語を含むいくつかのインド系文字にまで適用範囲を広げた。[ 9 ] [ 10 ]また、該当する場合にはインド・アーリア語のシュワー削除の規定も設けられた。例えば、ヒンディー語のकानपुरはkānpur(kānapuraではなく)と音訳されるが、サンスクリット語のक्रमはkrama ( kramではなく)と音訳される。このシステムは時を経て進化を遂げてきた。例えば、元のバージョンでは長母音にアクセント記号が付けられていたが、これは後に1954年のインド政府の更新でマクロンに置き換えられた。[ 11 ]そのため、जान(生命)は以前はjánとローマ字表記されていたが、 jānとローマ字表記されるようになった。ハンテリアンシステムは、音声的に正確な結果を生み出さないことや、「英語圏の読者層に露骨に配慮している」ことなどから、長年にわたり批判を受けてきた。[ 11 ]特に、そり舌音と歯音の区別がないこと(例えば、दとडはどちらもdで表される)は繰り返し批判され、そり舌音の下に発音記号を付けること(例えば、द = d、ड = ḍとすることで読みやすくなるが、発音記号の印刷が必要になる)や、大文字にすること(例えば、द = d、ड = Dとすることで発音記号の印刷は不要になるが、単語内に小文字と大文字が混在するため読みにくくなる)など、ハンテリアンシステムのいくつかの修正案が提案されてきた。[ 12 ]
コルカタ国立図書館のローマ字表記法は、すべてのインド系文字のローマ字表記を目的としており、 IASTの拡張版です。IAST との違いは、 एとओに ē と ō の記号を使用すること(e と o は多くのインド系言語に存在する短母音に使用されます)、子音 (カンナダ語) ಳに 'ḷ' を使用すること、およびॠ、ऌ、ॡの記号がないことです。
デヴァナーガリー文字だけでなく、すべての南アジア言語の標準的な音訳規則が、2001 年の ISO 15919 規格で成文化され、国際標準化機構 (ISO) の規範に準拠した現代のデジタルライブラリの基礎となっています。ISO 15919 は、さまざまな言語/文字の南アジアテキストのローマ字音訳のための共通の Unicode ベースを定義しています。
ISO 15919による翻字はプラットフォームに依存しないため、ISO規格に準拠している限り、あらゆる最新のオペレーティングシステムおよびソフトウェアパッケージで同様に使用できます。これはすべての最新プラットフォームにとって必須条件であるため、ISO 15919は南アジアのあらゆるテキストを翻字するためのデジタルライブラリおよびアーカイブの新しい標準となっています。
ISO 15919 [ 14 ]は、発音記号を使用して、はるかに大きなブラーフミー文字セットをラテン文字にマッピングします。デーヴァナーガリー文字固有の部分は、学術標準であるIAST : "International Alphabet of Sanskrit Transliteration" および米国議会図書館標準であるALA-LC [ 15 ]とほぼ同一です。
もう一つの標準規格である国連地理名ローマ字表記システム(UNRSGN)は、国連地理名専門家グループ(UNGEGN)[17]によって開発され、多くのブラーフミー文字を網羅しています。ISO 15919とUNRSGNの間にはいくつかの相違点があります[ 18 ] 。
IASTと比較すると、ハーバード・京都式ははるかにシンプルです。IASTに含まれるような発音記号は一切使用されていません。発音記号の代わりに、ハーバード・京都式では大文字が使われます。大文字を使うことで、ハーバード・京都式での入力はIASTよりもはるかに簡単になりますが、単語の中に大文字が含まれることになります。
ITRANSはHarvard-Kyotoの拡張版です。ITRANSの翻字方式は、インド系文字のプリプロセッサであるITRANSソフトウェアパッケージ用に開発されました。ユーザーがローマ字で入力すると、ITRANSプリプロセッサがローマ字をデーヴァナーガリー文字(またはその他のインド系文字)に変換します。ITRANSの最新バージョンは、2001年7月にリリースされたバージョン5.30です。
上記のASCII方式の欠点は、大文字と小文字を区別することであり、音訳された名前を大文字で表記できないという点です。この問題は、1996年にFrans VelthuisがTeX用に開発したシステム(IASTをベースに緩やかに開発されたもの)では回避されており、このシステムでは大文字と小文字は区別されません。
WX表記は、ASCIIでインド諸語を表すための音訳方式です。この方式は、インド諸語の計算処理のためにIITカンプールで考案され、インドの自然言語処理(NLP)コミュニティで広く使用されています。この表記は(正体は不明ですが)例えば、IITカンプールのNLPの教科書で使用されています。[1] この音訳方式の主な特徴は次のとおりです。すべての子音とすべての母音は、ローマ字に1つだけ対応付けられます。したがって、これは接頭辞コードであり、計算の観点から有利です。[2] 通常、小文字は無気音の子音と短母音に使用され、大文字は有気音の子音と長母音に使用されます。そり舌無声子音と有声子音は「t、T、d、D」にマッピングされ、歯音は「w、W、x、X」にマッピングされます。そのため、この方式の名前は「WX」で、独特なマッピングを指しています。 Ubuntu Linuxは、WX表記のキーボードサポートを提供しています。
SLP1 (Sanskrit Library Phonetic) は、サンスクリット ライブラリー[ 19 ]が最初に使用した大文字小文字を区別する方式で、ピーター シャーフと故マルコム ハイマンによって開発され、彼らの著書 Linguistic Issues in Encoding Sanskrit [ 20 ]の付録 B で初めて説明されました。SLP1 の他のエンコーディングに対する利点は、デーヴァナーガリー文字ごとに 1 つの ASCII 文字が使用されることであり、この特徴により逆転写が容易になります。[ 21 ]
ヒングリッシュとは、オンライン、特にソーシャルメディアで使用される非標準化されたローマ字表記のヒンディー語を指します。インドでは、ローマ字表記のヒンディー語がオンラインでの表現の主流となっています。PalakodetyらはYouTube のコメントを分析し、コメントの 52% がローマ字表記のヒンディー語、46% が英語、1% がデーヴァナーガリー文字のヒンディー語であることを明らかにしました。[ 22 ]
その他のあまり一般的ではないASCIIスキームには、WX表記、Vedatype、および7ビットISO 15919があります。WX表記は、インドの言語をASCIIで表現するための音訳スキームです。これは、インドの言語の計算処理のためにIIT Kanpurで生まれ、インドの自然言語処理(NLP)コミュニティで広く使用されています。このスキームは、NLP Panini ( 2013年11月26日アーカイブ) (付録B) で説明されています。ヴェーダ語サンスクリット語のカバー範囲に関しては、SLP1に似ていますが、SLP1ほど汎用性はありません。WXと他のスキームの比較は、Huet (2009)、付録Aにあります。Vedatypeは、 Maharishi University of Managementでヴェーダ語テキストをエンコードするために使用されている別のスキームです。これらのすべてのスキームにわたるオンライン変換ユーティリティがサンスクリット図書館で提供されています。ISO 15919には、発音記号を接頭辞に置き換えるいわゆる「限定文字セット」オプションが含まれているため、ASCIIと互換性があります。アンソニー・ストーンによる図解解説はこちらです。
以下は、デーヴァナーガリー文字に使用される主要な音訳方法の比較です[ 23 ]。
デーヴァナーガリー文字の単独の子音文字の後には、暗黙のシュワー(/ə/)が続きます。すべての音訳システムにおいて、その/ə/は「a」またはシュワーに相当する文字を用いて明示的に表す必要があります。
以下の表は、デーヴァナーガリー文字の翻字に関して、ISO 15919とIASTの相違点のみを示しています。
デーヴァナーガリー文字の子音には、シュワーと呼ばれる「固有の a」音が含まれており、音訳では明示的に「a」の文字で表す必要があります。デーヴァナーガリー文字から音訳された多くの単語や名前は、元のサンスクリット語の発音を示すために「a」で終わります。このシュワーは、ヒンディー語、パンジャブ語、マラーティー語など、いくつかの現代インド・アーリア語では必ず削除されます。このため、サンスクリット語とシュワーを削除する言語では、シュワーを保持または削除するなど、音訳が異なってきます。
語尾に「a」が残る単語もあるが、それは一般的に「a」がないと発音しにくいからである。
このため、子音クラスターで終わる単語は、さまざまな現代インド諸語で次のように変化します。Mantra=mantar。Shabda=shabad。Sushumna=sushumana。
ほとんどのインド諸語では、歯音のそり舌形と歯音形を区別しています。正式な音訳方式では、歯音形は標準的なローマ字で示され、そり舌形は特別な記号や他の文字で示されます。例えば、IAST音訳では、そり舌形はṇ、ṭ、ḍ、ṣです。
ほとんどの非公式な表記では、そり舌音と歯音の区別は示されていません。しかし、非公式なメッセージでは、QWERTYキーボードのそり舌音を大文字で表記する人が多くいます。そのため、一般的に音訳は不要になります。
デーヴァナーガリー文字の翻字で破裂音の後に「h」が続く場合、それは常に有気音を示します。したがって、「ph」は「pit」の「p 」のように発音され(発音時に少量の息を吐き出す)、決して「photo」の「ph」 ( IPA /f/)のようには発音されません。(一方、「p」は「spit」の「p」のように発音され、息を吐き出すことはありません。)同様に、「th」は有気音の「t」であり、 「this」の「 th」(有声音、IPA /ð/)でも「thin」の「 th」(無声音、IPA /θ/)でもありません。
気音は、一般的に正式な音訳システムと非公式な音訳システムの両方で示される。
インドでは英語が専門分野や高等教育の言語として広く使われているため、デーヴァナーガリー文字キーボードの普及率は英語キーボードに比べて著しく低い。同様に、インドでリリース・販売されるソフトウェアやユーザーインターフェースも英語で提供されており、コンピュータ教育の多くも英語で行われている。デーヴァナーガリー文字キーボードのレイアウトに関する知識が乏しいため、多くのインド人ユーザーはヒンディー語をローマ字で入力している。
デーヴァナーガリー文字がUnicodeに追加される前は、インターネット上でデーヴァナーガリー文字を表示するために多くの回避策が用いられており、デーヴァナーガリー文字をサポートするUnicodeフォントが広く利用可能になった後も、多くのサイトやサービスがそれらを使い続けています。ヒンディー語をローマ字に翻字するための翻字規則はいくつかありますが、そのほとんどは発音記号に依存しています。ほとんどのインド人は英語(伝統的に発音記号を使用しない)を通じてローマ字に慣れ親しんでいるため、これらの翻字システムはあまり広く知られていません。このような「ローマナーガリー」のほとんどは、英語の綴りを模倣するために恣意的に翻字されているため、多くの矛盾が生じています。
これは検索エンジンにとっても有害です。検索エンジンはローマ字表記のヒンディー語テキストをヒンディー語として認識しないからです。同じテキストでも英語として認識されない場合もあります。
物理キーボードのレイアウトに関わらず、ほとんどの最新のオペレーティングシステムにUnicodeベースのヒンディー語キーボードレイアウトをインストールすることが可能です。Google翻訳やMicrosoft Indic Language Input Toolなど、ヒンディー語辞書を参考にしながらローマ字で書かれたテキストをデーヴァナーガリー文字に正確に変換するオンラインサービスが多数存在します。このソリューションは、従来、複雑な文字を使用する言語、特に表意文字を使用する言語でテキストを入力するために使用されてきた入力方法エディタに似ています。
紀元前2千年紀から1千年紀にかけて、サンスクリット語のテキストは暗記と反復によって伝えられていました。ハラッパ文明後のインドには、カローシュティー文字とブラーフミー文字が作られるまで(紀元前4世紀から3世紀)、インド諸語を表記する体系がありませんでした。これらの文字体系は、アショーカ王碑文を含む中期インド諸語には適していましたが、サンスクリット語の表記には適していませんでした。しかし、ブラーフミー文字の後継者たちは、サンスクリット語を正確な音韻で記録できるように改良されました。サンスクリット語で書かれた最古の物理的なテキストは、西クシャトラパ王朝の支配者ルドラダマンが紀元150年頃にグジャラート州ジュナーガドで書いた岩刻碑文です。中世にブラーフミー文字のさまざまな変種が著しく増殖したため、今日ではサンスクリット語を表記するための単一の文字は存在しません。むしろ、サンスクリット語の学者は、それぞれの地域の言語を表記するのに使われている文字の形でサンスクリット語を表記することができます。しかし、中世後期以降、北インドの幅広い読者層に向けてサンスクリット語の文献を記述する際に、デーヴァナーガリー文字を用いる傾向が見られるようになった。
19世紀の西洋の学者たちは、サンスクリット語文献の印刷版にデーヴァナーガリー文字を採用した。マックス・ミュラーによるリグヴェーダの初版はデーヴァナーガリー文字で書かれていた。ミュラーのロンドンの植字工たちは、ペテルブルクでベートリンクとロートの辞書を制作していた同業者たちと、必要な合字活字をすべて彫る作業で競い合った。
西洋サンスクリット語学も、その黎明期から、この言語のローマ字表記の必要性を感じていた。フランツ・ボップは1816年に、デーヴァナーガリー文字と並行して、母音の長さを曲折アクセント記号(â、î、û)で、気音をスピリトゥス・アスペル(例えば、IASTのbhに対してbʽ)で表す点でIASTとは異なるローマ字表記法を用いた。IASTの歯擦音ṣとśは、それぞれスピリトゥス・アスペルとレニス(sʽ、sʼ)で表した。モニエ=ウィリアムズは1899年の辞書で、IASTのc、ś、ṣに対してそれぞれć、ṡ、shを使用した。
19世紀後半から、西洋におけるデーヴァナーガリー文字の組版への関心は低下した。テオドール・アウフレヒトは1877年にリグ・ヴェーダをローマ字サンスクリット語で出版し、アーサー・マクドネルの1910年のヴェーダ文法(および1916年の学生向けヴェーダ文法)も同様にデーヴァナーガリー文字を使用していない(ただし、学生向け入門サンスクリット文法では、ローマ字サンスクリット語と並んでデーヴァナーガリー文字も使用されている)。現代の西洋版サンスクリット語テキストはIASTとデーヴァナーガリー文字の両方で出版されており、後者の文字はUnicodeの普及と、LibreOfficeやXeTeXといったデーヴァナーガリー文字の書き方や出版を容易にする国際的なライティング技術の普及により人気が高まっている。
... 時が経つにつれ、デーヴァナーガリー文字および関連アルファベットの翻字には、ほぼ統一されたシステムが出現した。しかしながら、ローマ字化の単一のシステムはまだ開発されていない...
…ISO 15919…インド国内でも国際的な地図製品でも、このシステムが使用されている証拠はありません…ハンテリアンシステムは、インドで実際に使用されている国家的なローマ字表記システムです…
... インドではハンテリアン方式が用いられており、現地語のすべての音がローマ字の特定の文字で統一的に表される...
... 国際的に認められているハンテリアン式翻字システムが使用されています...
...音声学または「サー・ロジャー・ダウラー方式」...国務長官と彼の顧問の大多数は、ハンテリアン方式に無条件の支持を与えた...
...インド政府は科学的(つまりハンテリアン式)音訳の試みを全て放棄し、古い音声綴りへの回帰を最終的に決定する...
... ビルマ語の単語をローマ字で転写するシステムが存在し、「政府方式」または「ハンター方式」と呼ばれています...
ハンテリアン方式では、ヒンディー語、ウルドゥー語、アラビア語、ビルマ語、中国語、チベット語由来の名称を英語に音訳するための規則が定められています。これらの規則は、インド測量局の地形図作成ハンドブック第6章に記載されています。
... 19世紀後半の資料では、この表記法では長母音に鋭アクセント記号を付け、文字kとqを両方ともkと表記していた。しかし、1954年にこの表記法が再び出版された際には変更が加えられていた。長母音にはマクロン4が付けられ、qkの区別は維持された...
द
と
ड
、
र
と
ड़
、
त
と
ट
を
区別していないため、これに代わるものとして提案されました。...
…ISO 15919…インド国内でも国際的な地図製品でも、このシステムが使用されている証拠はありません…ハンテリアンシステムは、インドで実際に使用されている国家的なローマ字表記システムです…