| タミル語 தமிழ் | |
|---|---|
| スクリプトタイプ | |
期間 | 紀元400年頃~現在[1] [2] |
| 方向 | 左から右 |
| 言語 | タミル語 カニッカラン バダガ イルラ パニヤ サウラー シュトラ |
| 関連スクリプト | |
親システム | |
姉妹システム | グランサ、オールドモン、クメール、チャム、カウィ |
| 15924 規格 | |
| 15924 規格 | タミル語 (346)、タミル語 |
| ユニコード | |
ユニコードエイリアス | タミル語 |
| |
タミル文字(தமிழ் அரிச்சுவடி Tamiḻ ariccuvaṭi [tamiɻ ˈaɾitːɕuʋaɽi])は、インド、スリランカ、マレーシア、シンガポール、インドネシアなどのタミル人やタミル語話者がタミル語を書くために使用するアブギダ文字である。[5]インド共和国の公式文字の一つである。サウラーシュトラ語、バダガ語、イルラ語、パニヤ語などの少数言語もタミル文字で書かれている。[6]
特徴

タミル語文字には 12 個の母音( உயிரெழுத்து、uyireḻuttu、「魂の文字」)、18 個の子音( மெய்யெழுத்து、、「body-letters」)と 1 つの特殊文字ஃ ( ஆய்த எழுத்து、āytha eḻuttu )。ஃは「அக்கு」、akkuと呼ばれ、タミル語の正書法では子音でも母音でもないと分類されます。[7]しかし、それは母音セットの最後に記載されています。文字はアルファベットではなく音節文字です。左から右に書かれます。
歴史


タミル文字は、他のブラーフミー文字と同様に、元のブラーフミー文字から進化したと考えられています。[8]タミル語の表記例として認められている最古の碑文は、アショーカ王朝時代に遡ります。そのような碑文で使用されている文字は、一般にタミル・ブラーフミー文字または「タミル文字」と呼ばれ、標準的なアショーカ王朝ブラーフミー文字とは多くの点で異なります。たとえば、初期のタミル・ブラーフミー文字は、アショーカ王朝ブラーフミー文字とは異なり、純粋な子音(この例ではm)と固有の母音を持つ子音(この例ではma )を区別するシステムを持っていました。さらに、イラヴァタム・マハデーヴァンによると、初期のタミル・ブラーフミー文字では、わずかに異なる母音マーカーが使用され、サンスクリット語にはない文字を表す追加の文字があり、有声子音や無声音など、タミル語にない音の文字が省略されていました。[8] 2世紀の碑文ではタミル・ブラーフミー文字の後期形が使われており、これは古代タミル語の文法書であるトルカッピヤムに記述されている表記法と実質的に類似している。最も注目すべきは、固有の母音を抑制するためにプヒが使われていたことである。 [9]その後、タミル文字はより丸みを帯びた形へと進化し、5世紀または6世紀までに初期ヴァテフットゥと呼ばれる形に達した。[10]
しかしながら、現代のタミル文字はその文字から派生したものではない。[11] 4世紀、[12]パッラヴァ朝はタミル語のためにパッラヴァ文字と呼ばれる新しい文字を作り、グランタ文字はそこから発展して、サンスクリット語を書くのに見つからない音を表す Vaṭṭeḻuttu 文字を加えた。[4]グランタ文字と並行して、パッラヴァ朝とチョーラ朝の領土で、グランタ文字と同じ字体の発達に似た新しい文字(現代のタミル文字に発展したチョーラ=パッラヴァ文字)が再び出現したが、その形は大幅に縮小され、非ネイティブのタミル語の音を追い越すことはなかった。8世紀までには、タミル語圏の北部にあったパッラヴァ王国とチョーラ王国で、新しい文字が Vaṭṭeḻuttu に取って代わった。しかし、タミル語圏の南部、チェーラ王国とパンディヤ王国では、11世紀にパンディヤ王国がチョーラ朝に征服され、短期間パラヴァ朝の封建制を継承するまで、ヴァテフットゥ語は使用され続けました。 [3] [4]
パッラヴァ王国の崩壊とともに、チョーラ朝はチョーラ=パッラヴァ文字を事実上の文字として推し進めた。その後数世紀にわたり、チョーラ=パッラヴァ文字は現代のタミル文字へと進化した。グランタ文字とその親文字はタミル文字に顕著な影響を与えた。筆記の主な媒体としてヤシの葉を使用することで、文字が変化した。筆記者は、穴の開いた葉は破れやすく、早く腐ってしまうため、書くときに尖筆で葉を突き刺さないように注意する必要があった。その結果、純粋な子音を区別するためにプフフヒを使用することは稀になり、純粋な子音は通常、本来の母音が存在するかのように書かれるようになった。同様に、タミル語でகுற்றியலுகரம்、ローマ字表記: kuṟṟiyal-ukaram、文字通り「短い u 音」と呼ばれる母音マーカー ( ஃ )も使われなくなり、単純なuマーカー( ு ) に置き換えられました。これは一部の単語の末尾や特定の複合語の中間位置に出現し、短縮された u 音を示す半円音のuです。 puḷḷi ( ஂ )は印刷術が導入されるまで完全には再登場しませんでしたが、マーカーkuṟṟiyal-ukaram ( ஃ ) は、特定の文法概念語でその使用法が保持されているものの、この目的で使用されることは決してありませんでした。一方、その音自体は今でも存在し、タミル語の韻律において重要な役割を果たしています。
19 世紀には、文字の印刷を容易にするために、一部の文字の形が簡略化されました。20 世紀には、一連の改革で文字がさらに簡略化され、子音で使用される母音マーカーが、特殊なマーカーとほとんどの不規則な形を排除することで規則化されました。
他のインド文字との関係
タミル文字は、他のブラーフミー文字とはさまざまな点で異なります。他のすべてのブラーフミー文字とは異なり、タミル文字では、有声破裂音や有気破裂音を定期的に表しません。これは、破裂音の有声音および摩擦音はタミル語の音素ではないためです。ただし、破裂音の有声音および摩擦音は、タミル語の話し言葉には現れます。したがって、たとえば、文字க் k は/ k / を表しますが、タミル語音韻論の規則に基づいて[ g ] または [ x ]と発音することもできます。タミル文字を使用してサンスクリット語または他の言語を書く場合、これらの音には別の文字セットが表示されます。
また、他のブラーフミー文字とは異なり、タミル文字では連結子音を表すのに活字の合字がほとんど使用されません。連結子音は、他のインド言語に比べてタミル語では非常にまれです。連結子音が発生する場合は、最初の子音の文字を書き、固有の母音を抑制するためにpuḷḷiを追加し、次に 2 番目の子音の文字を書きます。いくつかの例外があり、 க்ஷ kṣaとஶ்ரீ śrīです。
ISO 15919 は、タミル語やその他のインド系文字をラテン文字に音訳するための国際標準です。この標準では、発音区別符号を使用して、はるかに大きなブラーフマ語の子音と母音のセットをラテン文字にマッピングします。
手紙


基本子音
子音は「体」(メイ)文字と呼ばれます。子音は、 vallinam(硬子音)、mellinam(軟子音、すべての鼻音を含む)、itayinam (中子音)の3つのカテゴリに分類されます。
単語の形成にはいくつかの語彙規則があります。Tolkāppiyamはそのような規則を説明しています。いくつかの例: 単語は特定の子音で終わることはできず、r-、l-、ḻ- などの一部の子音で始まることもできません。タミル語には、軟口蓋鼻音ங்、口蓋鼻音ஞ்、後屈鼻音ண்、歯鼻音ந்、両唇鼻音ம்、歯茎鼻音ன் の 6 つの鼻音子音があります。
タミル語のアルファベットの順序(厳密にはabugida)は、位置的にも言語的にも近隣言語の順序とよく一致しており、その文字がブラーフミー語に由来する共通の起源を反映しています。
タミル語には18の子音(mey eluttukkal )がある。伝統的な文法学者は、これら18の子音を6文字ずつの3つのグループに分類している。この分類は、発音方法と文字の性質に基づいて行われている。Vallinam (硬いグループ)、Mellinam(柔らかいグループ)、idaiyinam(中程度のグループ)。すべての子音は、単独で発音される場合、半単位(māttirai)の長さで発音される(母音と組み合わされた子音は、母音の長さで発音される)。[13]
タミル語で使用される追加の子音
タミル語には、トルカッピヤム分類に含まれていなかった多くの音素が組み込まれています。これらの音を書くために使用される文字はグランタと呼ばれ、タミル語の一部として使用されます。これらは小学校から教えられ、タミル語全文字エンコーディング (TACE16)に組み込まれています。
デーヴァナーガリー語のश्रीに相当する複合語ஶ்ரீ ( śrī ) もあります。
子音とஃ ( ஆய்த எழுத்து、āyda eḻuttu 、 nuqtaに相当) の組み合わせは、外国語の音素を表すために、特にイスラム教やキリスト教の文章を書くために時々使用されます。例: asif = அசிஃப்、azārutīn̠ = அஃஜாருதீன்、ジンギスカン= கெங்கிஸ் ஃகான்。[要出典]
バダガ語を書く際にはヌクタのような発音区別符号が使用され、イルラ語の音を書き写す際には二重点のヌクタが使用されます。 [15]
また、有声音と無声音を下付き数字で区別する試みも行われてきました。2、3、4はそれぞれ無声音、有声音、有声音有声音を表します。これは、下の表に示すように、サンスクリット語とタミル語の書籍でサンスクリット語の単語を転写するために使用されました。[16] [17]
ユニコード標準では、ப² pha、ப³ ba、ப⁴ bhaのように、上付き数字を同じ目的で使用しています。[18]
母音
母音は「生命」文字(uyir)または「魂」文字とも呼ばれます。子音(mei、「身体」文字と呼ばれる)と一緒に、複合音節文字(abugida)を形成し、「生きた」または「具現化された」文字(uyir mei、つまり「身体」と「魂」の両方を持つ文字)と呼ばれます。
タミル語には、短母音と長母音(それぞれ 5 つずつ)と 2 つの二重母音に分かれた 12 個の母音があります。
複合形
子音「k」を例に挙げます。
3つの点で表される特別な文字ஃは、 āyta eḻuttuまたはaḵと呼ばれます。これはもともと、現代のほぼすべてのドラヴィダ語族言語で失われたドラヴィダ語の音 ḥ の古風なタミル語での保持を表し、タミル語では伝統的に純粋に文法的な機能を果たしていましたが、現代では外来音を表す分音記号として使われるようになりました。たとえば、ஃப は英語の音f を表しますが、タミル語には存在しません。また、ヤシの葉が固有の子音母音 u で終わる単語の主要な表記媒体になる前は、短い u の発音規則として使われていました。タミル語: குற்றியலுகரம்、ローマ字表記: kuṟṟiyal-ukaram、直訳すると 「クアリャル・ウカラム」。 「短い 'u' 音」。この動作をする子音は、கு、சு、டு、து、பு、றுです。現代のようにマーカーなしで書くのではなく (タミル語: அது、ローマ字: Atu )、前にஃ を付けて、タミル語: அஃது、ローマ字: Aḥtuのよう に書かれました。
もう一つの古風なタミル文字ஂ は、小さな白抜きの円で表され、Aṉuvaraと呼ばれ、 Anusvaraです。これは伝統的に、子音の前では同有機鼻音として使用され、単語の終わりでは文脈に応じて 両唇鼻音 ( m ) または歯茎鼻音 ( n ) として使用されます。
長母音 ( nedil ) は短母音 ( kuṟil )の約 2 倍の長さです。二重母音は通常、短母音の約 1.5 倍の長さで発音されますが、一部の文法テキストでは、二重母音を長母音 ( nedil )と一緒に発音しています。
複合形に見られるように、母音記号は子音の右側、左側、または両側に追加できます。また、合字を形成することもできます。これらの規則は進化しており、古い用法では現代の用法よりも多くの合字があります。このページに実際に表示される内容は、フォントの選択によって異なります。たとえば、Code2000 ではLatha よりも多くの合字が表示されます。
すべての合字を排除し、すべての母音記号を右側に表示することを望む文字改革の支持者もいます。
Unicode は文字を論理順序 (常に子音が最初) でエンコードしますが、従来の 8 ビット エンコーディング ( TSCIIなど) では記述順序が優先されます。このため、あるエンコーディングから別のエンコーディングに変換するときには順序を変更する必要があり、1 つのコード ポイント セットを他のコード ポイント セットにマッピングするだけでは不十分です。
タミル文字の複合表
次の表では、上部に母音 ( uyirまたは life) の文字、側面に子音 ( meiまたは body) の文字がリストされており、その組み合わせによりすべてのタミル語の複合文字 ( uyirmei ) が得られます。
書き順
数字と記号
通常の数字(0から9)の他に、タミル語には10、100、1000の数字もあります。分数やその他の数字に基づく概念を表す記号も見られます。[19]
ユニコード
タミル文字は、1991 年 10 月にバージョン 1.0.0 のリリースでUnicode標準に追加されました。タミル文字の Unicode ブロックは U+0B80 ~ U+0BFF です。灰色の領域は、割り当てられていないコード ポイントを示します。割り当てられていないコード ポイントのほとんどは、タミル文字に存在しない音素に対応する他の南アジアの文字ブロックで割り当てられた文字と同じ相対位置にあるため、予約済みとして指定されています。
グランタ文字とタミル文字を統一する努力がなされてきたが[16] [20]、その提案は一部の人々の不満を招いた。[21] [22]最終的には、関連する繊細さを考慮して、数字を除いて2つの文字を独立してコード化することが決定された。[23]
伝統的な会計慣行で小数値に使用される文字をエンコードする提案が提出されました。[24]スリランカのICTAはこれを推奨しませんでしたが、[25]タミル・ナードゥ州政府はこの提案を認め、 [26] 2019年3月にバージョン12.0のリリースとともにUnicode標準に追加されました。タミル・サプリメントのUnicodeブロックはU+11FC0〜U+11FFFです。
音節文字
Unicode の他の南アジア文字と同様に、タミル語のエンコードはもともとISCII標準から派生したものです。ISCII と Unicode はどちらもタミル語をabugidaとしてエンコードします。abugida では、各基本文字が子音とデフォルトの母音を表します。異なる母音を持つ子音または裸の子音は、基本文字に修飾文字を追加することで表されます。同様の音素を表す各コード ポイントは、タミル語を含む Unicode の各南アジア文字ブロックで同じ相対位置にエンコードされます。Unicode はタミル語を abugida として表すため、以下の Unicode タミル語音節表に示すように、タミル語のすべての純粋な子音 (関連する母音を持たない子音) と音節は、複数の Unicode コード ポイントを組み合わせることで表すことができます。Unicode 5.1 では、すべてのタミル語の子音と音節に名前付きシーケンスが追加されました。
Unicode 5.1には、タミル語の合字SRI ( śrī )、ஶ்ரீの名前付きシーケンスもあり、 ஶ ( śa )を使用して書かれます。このシーケンスの名前はTAMIL SYLLABLE SHRIIで、UnicodeシーケンスU+0BB6 U+0BCD U+0BB0 U+0BC0で構成されています。この合字はஸ ( sa )を使用して書かれ、UnicodeシーケンスU+0BB8 U+0BCD U+0BB0 U+0BC0で構成される同一の合字ஸ்ரீを作成することもできますが、これはUnicode標準では非推奨です。[27]
プログラムによるアクセス
- タミル文字はopen-Tamilと呼ばれるPythonライブラリを使用して操作できます。[28]
- C# を使用した AnyTaFont2UTF8 という Windows オープン ソース アプリケーションが利用可能です。
参照
説明ノート
注記
- ^ Rajan, K. (2001 年 12 月)。「記念碑から読み解く領土区分」。イースト アンド ウェスト。51 (3/4)。イタリア・アフリカ・オリエント研究所 (IsIAO): 363。JSTOR 29757518 。(601年から800年までのタミル語を並べた表)
- ^ ディリンジャー、デイヴィッド(1948年)。アルファベット:人類の歴史への鍵。385ページ。
- ^ マハデヴァン2003、212ページ。
- ^ abc マハデヴァン2003、213ページ。
- ^ アレン、ジュリー(2006)、ユニコード5.0標準(第5版)、アッパーサドルリバー、ニュージャージー:アディソンウェズリー、ISBN 0-321-48091-0324ページ
- ^ Lewis, M. Paul 編 (2009)、Ethnologue: Languages of the World (第16版)、Dallas, Tex.: SIL International 、2009年8月28日閲覧
- ^ マドラス大学タミル語辞典、148 ページ: 「அலியெழுத்து [ aliyeḻuttu n ali-y-eḻuttu . < அலி ¹ +. 1. 文字ஃは、母音でも子音ともみなされません。ஆ 」 ய்தம் ( வெண்பாப்。முதன்மொ。 6、 உரை ) 2. 子音。 ழுத்து。 (பிங்。)。 "]
- ^ マハデヴァン2003、173ページ。
- ^ マハデヴァン2003、230ページ。
- ^ マハデヴァン2003、211ページ。
- ^ マハデヴァン2003、209ページ。
- ^ グリフィス、アルロ(2014)。「東南アジアの初期インド碑文」。
- ^
ウィキバーシティのタミル語/文字に関する学習教材
- ^ abc スティーバー 1996、p. 426-430。
- ^ Unicode 標準バージョン 13.0 – コア仕様、南アジアおよび中央アジア-I、インドの公式スクリプト、498 ページ
- ^ ab Sharma, Shriramana. (2010a). 拡張タミル語の文字をエンコードする提案。
- ^ Sharma, Shriramana. (2010c). 拡張タミル語提案のフォローアップ#2。
- ^ Unicodeコンソーシアム (2019). タミル語. Unicode標準バージョン12.0 (pp. 489–498)。
- ^ Selvakumar, V. (2016). タミル地域における数字と分数および算術計算の歴史:いくつかの観察HuSS: 国際人文社会科学研究ジャーナル、3(1)、27–35。https://doi.org/10.15613/HIJRH/2016/V3I1/111730
- ^ Sharma, Shriramana. (2010b). 拡張タミル語提案L2/10-256Rのフォローアップ。
- ^ Eraiyarasan, B. Dr. B. Eraiyarasan による Tamil Unicode および Grantham の提案に関するコメント。
- ^ Nalankilli, Thanjai. (2018). タミル語の Unicode をグランタ文字で「汚染」しようとする試み。タミル・トリビューン。2019 年 3 月 12 日に http://www.tamiltribune.com/18/1201.html から取得。
- ^ インド政府 (2010)。Grantha 文字の Unicode 標準。
- ^ Sharma, Shriramana. (2012). タミル語の分数と記号をエンコードする提案。
- ^ スリランカICTA (2014)。タミル語の記号と分数をエンコードするための提案に対するコメント。
- ^ タミル・ナードゥ州政府 (2017)。タミル語の分数と記号をエンコードするための最終提案。
- ^ Pournader, Roozbeh (2018年1月24日). 「タミル・シュリを表す2つの方法」. Unicode . 2023年4月4日時点のオリジナルよりアーカイブ。
- ^ 「Open-Tamil 0.65: Python パッケージ インデックス」。
参考文献
- マハデヴァン、イラヴァタム(2003年)、初期タミル碑文学、最古の時代から6世紀まで、ハーバード東洋シリーズ、第62巻、ケンブリッジ:ハーバード大学出版局、ISBN 0-674-01227-5
- Steever, Sanford B. (1996)、「タミル語の書き方」、Bright, William、Daniels, Peter T. (編)、The World's Writing Systems、ニューヨーク: Oxford University Press、pp. 426–430、ISBN 0-19-507993-0
外部リンク
- キーラディ遺跡の発見物は紀元前6世紀に遡る
- タミル語のアルファベットと基礎(PDF) 2014年8月8日にWayback Machineにアーカイブされました
- タミル語の音声学
- Unicode チャート – タミル語 ( PDF )
- TACE 16 (PDF)
- タミル語を学ぶ
- タミル文字
- タミル語 Unicode キーボード
