| アラビア語アルファベット | |
|---|---|
| スクリプトタイプ | |
期間 | 紀元3世紀~現在[1] |
| 方向 | 右から左に書く文字 |
| 言語 | アラビア語 |
| 関連スクリプト | |
親システム | |
| 15924 認証 | |
| 15924 認証 | アラブ人 (160)、アラビア語 |
| ユニコード | |
ユニコードエイリアス | アラビア語 |
| |

アラビア文字[a]またはアラビア語アブジャドは、アラビア語を表記するために特に体系化されたアラビア文字である。右から左に筆記体で書かれ、28の文字[b]があり、そのほとんどが文脈に応じた字形を持つ。現代のラテンアルファベットとは異なり、この文字には大文字と小文字の概念がない。アラビア文字はアブジャドとみなされ、子音のみを表記する必要がある。母音を表記するために分音記号を任意で使用するため、不純なアブジャドとみなされている。[2]
手紙
基本的なアラビア語のアルファベットには 28 個の文字があります。アラビア文字を使用して他の言語を書く形式では、文字が追加または削除されました。たとえば、アラビア文字の適応では、 ⟨پ⟩ が/p/ を表すためによく使用されます。ギリシャ語由来のアルファベットとは異なり、アラビア語には大文字と小文字の明確な字形がありません。
多くの文字は似ていますが、中央部分 ( rasm )の上または下の点 ( ʾiʿjām ) によって互いに区別されます。これらの点は、異なる音を表す文字を区別するため、文字の不可欠な部分です。たとえば、アラビア文字のب b、ت t、およびث th は、基本的な形は同じですが、それぞれ下に 1 つの点、上に 2 つの点、上に 3 つの点が追加されています。文字ن nも、頭字と中間形では同じ形ですが、上に 1 つの点が追加されていますが、単独の形と末尾の形は多少異なります。歴史的には、 rasmと呼ばれる書体で、これらはしばしば省略されていました。
アラビア語の印刷文字と書き文字はどちらも筆記体で、単語内のほとんどの文字は隣接する文字と直接結合されています。
アルファベット順
アラビア語のアルファベットには、Hija'iとAbjadiという 2 つの主な照合順序(「アルファベット順」)があります。
ヒジャイ順序 ( هِجَائِيّ Hijāʾiyy /hid͡ʒaːʔijj/ ) はより一般的な順序であり、電話帳、教室のリスト、辞書などの単語や名前のリストを並べ替えるときに使用されます。この順序では、文字の形状のグラフィック類似性によって文字がグループ化されます。
元々のアブジャディ順序 ( أَبْجَدِيّ ʾabjadiyy /ʔabd͡ʒadijj/ ) は、フェニキア文字で使用されていた順序に由来しており、そのためヘブライ語やギリシャ語などの他のアルファベットの順序を彷彿とさせます。この順序では、文字はアブジャド数字と呼ばれる数字としても使用され、ヘブライ語のゲマトリアやギリシャ語のイソプセフィと同じ数秘術コードを持ちます。
ヒジャイ
現代の辞書やその他の参考書では、アルファベット順に並べるのにアブジャディ順序は使用されていません。代わりに、文字が形状の類似性によって部分的にグループ化される、より新しいヒジャイ順序が使用されています。ヒジャイ順序は数字として使用されることはありません。
マグリブでは他のヒジャーイ順序が使われていましたが、現在では時代遅れとみなされており、順序は次のとおりです。 [3]
アブ・ムハンマド・アル・ハサン・アル・ハムダニの百科事典الإكليل من أخبار اليمن وأنساب حمير Kitāb al-Iklīl min akhbār al-Yaman wa-ansāb Ḥimyarでは、文字列は次のとおりです。[4]

アブジャディ
アブジャディ順は、アラム語の文字サメク 𐡎 に対応する位置を持っているため、以前の北セム語のアルファベット順と単純に一致するものではありませんが、歴史的にアラビア語のアルファベットには同族の文字がありません。
同じ損失は以下によって補償されました:
- マシュリク文字のアブジャド順序では、文字ﺱ sīnがsameḵの代わりになり、文字ش shīnがšīn 𐡔の代わりになりました。
- マグレブのアブジャド文字では、文字ṣāḏē 𐡑がض ḍadとص ṣadという 2 つの独立したアラビア文字に分割され、後者がsameḵに取って代わりました。
北セム語のどの文字にも対応しない他の 6 つの文字は末尾に配置されます。
これは一般的に次のように発音されます。
- ʾabjad hawwaz ḥuṭṭī kalaman saʿfaṣ qarashat thakhadh ḍaẓagh。
別の発声法は次のとおりです。
- アブジャディン・ハワジン・ハウティヤ・カルマン・サファシュ・クリシャット・タクード・ダタウーグ[要出典]
これは次のように発音できます。
- アブジャディン ハワジン ḥuṭiya カルマン シャファファ クリサット タクドゥ ハーグシュ
手紙の形式
アラビア語のアルファベットは常に筆記体で、文字の形は単語内の位置によって変化する。文字は、語頭、語中(真ん中)、語末、孤立位置(IMFI)に対応して最大4つの異なる形をとることができる。かなりの変化が見られる文字もあれば、4つの位置すべてでほぼ同じままの文字もある。一般的に、同じ単語内の文字は両側が短い水平線で結ばれているが、6つの文字(و 、ز 、ر 、ذ 、د 、ا)は前の文字としか結べない。さらに、一部の文字の組み合わせは合字(特殊な形)で書かれ、特にlām-alif لاは唯一の必須合字である(合字になっていない組み合わせلاは読みにくいとされている)。
基本文字表
注記
- ^ アラビア語: الْأَبْجَدِيَّة الْعَرَبِيَّة al-ʾabjadiyyah l-ʿarabiyyah [alʔabd͡ʒaˈdijːa‿lʕaraˈbijːa]
- ^ ハムザ<ء>は文字とみなすことができますが、アルファベットの一部ではありません。
- ^ ローマ字表記は各システムや国によって異なります。たとえば、ج はエジプトではGに、他のほとんどのアラビア諸国ではJにローマ字表記されます。
- ^ 以下のアラビア語の文字名は標準的かつ最も一般的に使用されている名前であり、代わりに他の名前(エジプトの文字名など)が使用される場合もあります。
- ^ ab アリフはさまざまな音素を表すことができます。最初は a/i/u /a, i, u/ ですが、定冠詞 ال (a)l- では発音されないこともあります。中間と最後は長母音 ā /aː/ を表します。また、一部のハムザ /ʔ/ 形式でも使用されます。#ハムザ形式を確認してください。
- ^ 現代標準アラビア語 (الفصحى al-Fuṣḥā) を話す場合、جの発音は地域によって異なり、アラビア半島のほとんど、レバントの一部、エジプトの一部 (特に田舎と上エジプト)、イラク、アルジェリア北中部で最も顕著なのは [d͡ʒ] であり、コーランを暗唱する際やアラブ世界以外のアラビア語研究においても文芸アラビア語の主な発音とみなされている。北西アフリカのほとんど、レバントの一部 (特に都市部)、アラビア半島の一部では [ʒ] である。一方、[ɡ] はエジプトでのみ標準的な発音であり ([ɡ] はイエメン沿岸部とオマーン沿岸部で方言発音として現れる)、スーダンでは [ɟ] である。
- ^ زこの文字の標準的な名前は zāy زايですが、誤って「zayn」 زينと呼ばれることもあります 。
- ^ シリアルナンバーやナンバープレートなどの特定の文脈では、西洋の数字のゼロや東洋のアラビア数字の5(٥)との混同を避けるために頭文字が使われます。また、文字を別々に書く場合は、単独の形式هを使用するのではなく、頭文字هـが通常使用されることにも言及する価値があります。
- ^ ab 文字⟨ و ⟩と⟨ ي ⟩は、それぞれ借用語と方言で母音/ oː /と/ eː /を転写するために使用される。⟨ و ⟩は、عمرو Amr /ʕamr/という名前でも黙字として現れ、誤ってAmroまたはAmruとローマ字化されることがある。
- ^ エジプトとスーダンでは、yā' ي は孤立した最後の位置では点がなく、ʾalif maqṣūrah ى と融合します。
- ^ は 文字とみなされ、アラビア語の綴りにおいて重要な役割を果たしますが、アルファベットの一部とはみなされません。
- さまざまな音訳方式の詳細については、 「アラビア語のローマ字表記」の記事を参照してください。アラビア語話者は、単語や名前を音訳するときに、通常、標準化された方式に従わない場合があります。英語に相当する文字がないアラビア文字 (ط など) は、ローマ字表記すると数字として綴られることがよくあります。また、名前は、文語アラビア語(アラビア語由来の場合) の発音ではなく、現地の発音で音訳されるのが一般的です。
- 発音に関しては、学校や大学で教えられている現代標準アラビア語の音素値を示しています。実際には、発音は地域によってかなり異なる場合があります。アラビア語の発音の詳細については、「アラビア語の音韻論」および「アラビア語の変種」の記事を参照してください。
- アラビア文字の名前は、セム祖語で意味のある単語であった古いバージョンの抽象化と考えることができます。
- 6 つの文字 ( و ز ر ذ د ا ) には明確な中間形がなく、次の文字と接続せずに最終形で書く必要があります。最初の形は、単独の形と一致します。次の文字は最初の形で書かれますが、単語の最後の文字の場合は単独の形で書かれます。
- 文字alif は、声門閉鎖音を示す子音記号としてフェニキア文字に由来します。今日では子音としての機能を失い、ya' およびwāwとともにmater lectionis、つまり長母音の代わりとなる子音記号 (下記参照) として、または特定の発音区別符号 ( maddahおよびhamzah ) のサポートとして使用されています。
- アラビア語では現在、声門閉鎖音[ʔ]を表すためにハムザ( ء )と呼ばれる句読点を使用しており、単独で書かれる場合もあれば、助動詞とともに書かれる場合もあります。
- 一人で: ء
- キャリア付きの場合: إ أ (アリフの上または下)、ؤ (ワウの上)、ئ (点のないヤーまたはヤー ハムザの上)。
- 学術的な著作では、ハムザはウィクショナリーでは修飾文字の右半環(ʾ) または ( ʔ ) で翻字されるが、ウィクショナリーでは修飾文字の左半環(ʿ) または ( ʕ ) は、英語にはない異なる音を表す文字'ayn ( ع ) を翻字する。
- ハムザは、前後の文字と結びつくことがないため、単一の形式を持ちます。ただし、wāw、yā'、またはalifと組み合わせられることもあり、その場合、そのキャリアは通常のwāw、yā'、またはalifのように動作します。下の表を確認してください。
ハムザフォーム
ハムザ音(声門閉鎖音)は、文字のように単独で書くことも、補助音を付けて発音区別符号として書くことも出来ます。[7]各形式の表記規則については、ハムザ音を調べてください。
ハムザット・アル・ワスル(هَمْزَةُ ٱلْوَصْلِ、「接続のハムザ」)は、文字ハムザ(ء )の変形であり、文字シャド(ص )の一部に似ていますが、単語の先頭(ٱ )の文字アリフの上に置かれることはほとんどありません。これは、アリフが声門閉鎖音として発音されるのではなく(ハムザと書かれる)、単語が前の単語に接続されていることを示しています(フランス語のリエゾンのように)。音声化された典礼テキスト以外では、ワスルは通常書かれません。[8] [9]たとえば、Abdullah عَبْدُ ٱلله は、ٱللهという単語の最初の文字に hamzat al-wasl を付けて書くこともできますが、ほとんどの場合、それなしでعَبْدُ اللهと書かれます。
修正された文字
以下は個々の文字ではなく、アラビア文字の一部の異なる文脈上の変形です。
二重化
二重発音は子音を二重にすることです。アラビア語では、文字を2度書く代わりに、その上にshaddahと呼ばれるW字型の記号を置きます。2つの子音の間に母音が来る場合、文字は単に2度書かれることに注意してください。分音記号は、1つの音節の最後の子音が次の音節の最初の子音と同じ場合にのみ表示されます。(このような分音記号の総称はḥarakātです)。たとえば、درس darasa (完全な分音記号付き: دَرَسَ ) は「勉強する」を意味する動詞の第1形態ですが、درّس darrasa (完全な分音記号付き: دَرَّسَ ) は対応する第2形態の動詞で、真ん中のr子音が二重になっており、「教える」を意味します。
ナネーション
ヌネーション (アラビア語: تنوين Tanwīn ) は、名詞または形容詞 に最後の-nを追加することです。前の母音は文法上の大文字と小文字を示します。アラビア語の書き言葉では、母音発音は単語の末尾にある母音の発音記号を 2 倍にすることで示されます。例: شُكْرًا šukr an [ʃukran]「ありがとう」。
合字
_in_the_word_Allah_only_black.png/500px-Arabic_components_(letters)_in_the_word_Allah_only_black.png)
1. alif
2. hamzat waṣl ( ْهَمْزَة وَصْل ) 3. lām 4. lām 5. shadda ( شَدَّة ) 6. dagger alif ( أَلِفْ خَنْجَریَّة ) 7. hāʾ
アラビア語では合字がよく使われる。必須の合字はlām ل + alif اで、2つの形式がある。その他の合字は数多くあるが[10]、すべて任意である。
7 つの異なる要素を組み合わせたより複雑な合字は、一般的にアッラーという単語を表すために使用されます。
Unicode のアラビア文字の主要範囲(U+06xx)内の唯一の合字はlām + alifです。これは、フォントとワードプロセッサに必須の唯一の合字です。他の範囲は、古い標準との互換性を保つためのもので、オプションの他の合字が含まれています。
- ラーム+アリフ
- ラジオ
注: UnicodeU+FEFBの Presentation Form B FExx 範囲にもこの合字のコードがあります。ブラウザとフォントがアラビア語用に正しく設定されていれば、上に表示される合字は、アラビア語の LAM と ALEF の分離形式である合字
と同一のはずです。
- ﻻ
U+0640アラビア語のタトウィール +ラーム+アリフ- アラビア
注: Unicodeの Presentation Form B U+FExx 範囲にもこの合字のコードがあります。ブラウザとフォントがアラビア語用に正しく設定されていれば、上に表示される合字は次のものと同じになります。
U+FEFCアラビア語の合字 LAM と ALEF の終止形- ﻼ
Unicode表示形式 Aの別の合字U+FB50 から U+FDxx の範囲は、合字Allāh (「神」)のグリフの特殊コードです。U+FDF2アラビア語合字 ALLAH 分離形式:
- ﷲ
これは、コーラン中のAllāhという単語の母音記号を正しく表示できないほとんどのテキスト プロセッサの欠点を回避するための方法です。アラビア文字はコーランだけでなく他のテキストの記述にも使用されるため、前述の合字のようにlām + lām + hā'をレンダリングするのは誤りであると考えられます。
この簡略化されたスタイルは、特にアラビア語以外の言語では明瞭さのために好まれることが多いが、より精巧な書道スタイルが好まれる状況では適切ではないと考えられるかもしれない。 – SILインターナショナル[11]
いくつかのフォント (Noto Naskh Arabic、mry_KacstQurn、KacstOne、Nadeem、DejaVu Sans、Harmattan、Scheherazade、Lateef、Iranian Sans、Baghdad、DecoType Naskh) のいずれかがコンピューターにインストールされている場合 (Iranian Sans は Wikimedia Web でサポートされています)フォント)、単語は発音記号なしで表示されます。
- lām + lām + hā' = LILLĀH (意味は「アッラー(神のみ)に」)
- لله または لله
- alif + lām + lām + hā' = ALLĀH(アラビア語で「神」の意味)
- الله または الله
- alif + lām + lām +
U+0651アラビア語 SHADDA +U+0670アラビア文字の上付き文字 ALEF + hā'- اللّٰه ( DejaVu SansとKacstOneでは追加された上付き文字 Alef は表示されません)
自動的に二重音符と上付き文字のアリフを追加せずに、欠陥のあるフォントでそれらを表示する試みは、すべてのブラウザで希望どおりに表示されない可能性がありますが、U+200d最初のまたは2番目のラームの後に(ゼロ幅ジョイナー)を追加します。
- (アリフ+ )ラーム+ラーム+
U+200dゼロ幅結合子 + hā'- «
母音
アラビア語の使用者は通常、長母音を書き、短母音は省略するため、読者は欠けている母音を補うために言語の知識を活用する必要があります。しかし、教育システム、特にアラビア語の文法の授業では、これらの母音が文法上重要であるため使用されます。アラビア語の文章は、母音の微妙な変化によってまったく異なる意味を持つことがあります。そのため、コーランなどの重要なテキストでは、アラビア語の発音区別符号や、カンティレーション記号などの他の種類の記号など、3 つの基本的な母音記号が義務付けられています。
短母音
日常的に使用されるアラビア語の手書き文字、一般出版物、道路標識では、短母音は通常書かれていません。一方、コーランのコピーは、発音区別符号が含まれていなければ、それを検査する宗教機関によって承認されません。児童書、小学校の教科書、およびアラビア語の文法書全般には、ある程度発音区別符号が含まれています。これらは「音声化」テキストとして知られています。
短母音は、音節内でその前にくる子音の上または下に発音区別符号を付けて書かれる場合があり、これをḥarakātと呼びます。アラビア語のすべての母音は、長母音も短母音も子音の後に続きます。たとえば、アラビア語では、「Ali」や「alif」などの単語は子音で始まります: 'Aliyy、alif。
長母音
コーランなどのテキストに見られる完全に音声化されたアラビア語テキストでは、ハムザ以外の子音に続く長いā は、子音の上に短いa記号 ( fatḥah ) を付けて、その後にアリフを付けて書きます。長いī は、短いiを表す記号( kasrah ) とyāʾ を付けて書き、長いū は、短いuを表す記号( ḍammah )とwāwを付けて書きます。簡単に言うと、ᵃa = ā、ⁱy = ī、ᵘw = ūです。ハムザに続く長いā は、アリフマッダ、またはフリーハムザとそれに続くアリフで表すことができます(アラビア語では、アリフが2つ連続することは決して許されません)。
下の表は、主要な子音文字またはシャッダ記号の代わりに、点線の円の上または下に置かれた母音を示しています。表をわかりやすくするために、これらの長母音を示すために使用される左側の主要な文字は、独立した形式でのみ示されています。ほとんどの子音は左側に接続し、ʾalif、wāw、およびyāʾ は中間形または末尾形で書かれます。さらに、最後の行の文字yāʾ は左側の文字に接続する場合があり、中間形または頭字形を使用します。主要な文字の表を使用して、実際のグリフと接続タイプを確認します。
無母音化テキスト(短母音が表記されていないテキスト)では、長母音は該当する母音で表されます:ʾalif mamdūdah/maqṣūrah、wāw、またはyāʾ。無母音化テキストの単語の途中に書かれた長母音は、完全な発音区別符号のあるテキストではsukūn(下記参照)付きの子音のように扱われます。ここでも、表はわかりやすくするために長母音文字を単独でのみ示しています。
واとيا の組み合わせは、常にそれぞれwāとyā と発音されます。例外は、動詞の語尾に付く接尾辞ـوا۟で、 ʾalif は発音されず、ūまたはawになります。さらに、名前や借用語を音訳する場合、アラビア語の話者は、ほとんどまたはすべての母音を長音で書きます ( āはا ʾalifで、ēとī はي yaʾで、ōとūはو wāwで)。つまり、これは真のアルファベットに近づくことを意味します。
二重母音
二重母音 حروف اللين ḥururufu l-līn /aj/および/aw/は、音声化されたテキストでは次のように表されます。
最後のyaʾ は 通常、ニスバ( اَلنِّسْبَة nisbah )の語尾に書かれます。これは、関係性または関連性の形容詞を形成する一般的な接尾辞です。接尾辞は男性の場合はـِيّ -iyy (女性の場合はـِيَّة -iyya(t)- ) です。たとえば、اِشْتِرَاكِيّ ištirākiyy は「社会主義者」ですが、 جندي jundiyy の「兵士」のように、人間やその他の感覚を持った存在に適用される単数形の語尾にも使用されます。しかし、今日ではこの最後のyaʾ は 、ほとんどの場合、長いyaʾ ( yāʾ mamdūdah ) -īで発音され、 اِشْتِرَاكِيّ ištirākiyy /iʃtiraːkijj/ではなくاِشْتِرَاكِي ištirākī /iʃtiraːkiː/のように発音されます。
同様の間違いは、今日ではجَرُوا jaru /d͡ʒaruː/と発音されるجَرَوْا jaraw 「彼らは走った」のように、一部の三人称複数動詞の語尾で発生します。
母音省略
アラビア語の音節は、開音節(母音で終わる)と閉音節(子音で終わる)に分けられます。
- 開く: CV [子音-母音] (長母音または短母音)
- 閉音: CVC (短母音のみ)
通常のテキストは、一連の子音と母音を長くする文字のみで構成されます。したがって、 「心」を意味するqalbという単語はqlbと書かれ、「彼は振り向いた」を意味するqalaba という単語もqlbと書かれます。
この曖昧さなしにqalaba を書くには、その上にfatḥah を書いて、lの後に短いaが続くことを示すことができます。
qalbと書くときは、 l の後に母音が続かないことを示すために、 قلْبのように、 sukūn ( ْ )と呼ばれる発音区別符号を付けます。
これは完全な発声から一歩進んだもので、 qの後の母音もfatḥahによって示されます: قَلْب。
コーランは伝統的に完全な音声で書かれています。
コーランのいくつかの版では、長音のiはkasrah の後に発音区別符号のないyが続き、長音のuはḍammahの後に裸のwが続く形で書かれる。他の版では、これらのyとw はsukūn を伴う。コーラン以外では、後者の慣例は非常にまれであり、yとsukūn は二重母音の/aj/と明確に読み上げられ、wとsukūn は/aw/と読み上げられる。
たとえば、文字myl は英語のmeelやmailのように読むことができますし、(理論的には)mayyalやmayilのようにも読むことができます。しかし、yにsukūnが追加されると、mにはsukūn を付けることができず(2 文字続けてsukūnすることはできないため)、ḍammah を付けることができず(アラビア語ではyの後に別の母音がない限りuy の音は出ないため)、kasrah を付けることができず(sukūnされたyの前のkasrah はコーラン以外では見つからないため)、fatḥahが必ずあり、唯一の可能な発音は/majl/(マイル、または電子メールを意味する)になります。同様に、yの上にsukūnが付いた myt はmaytにはなりますが、 mayyitやmeet にはなれません。また、 wの上にsukūnが付いた mwt はmawtにしかなれませんが、mootにはなれません( w が音節を閉じる とiwは不可能です)。
母音記号は、実際の発音ではi'rāb母音を省略しなければならない場合でも、常に i'rāb 母音が実際に発音されているかのように表記されます。したがって、 Aḥmadという名前を書く場合、 ḥにsukūn を置くことは任意ですが、dにsukūn を置くことは禁止されています。これは、他の単語が続くとḍammahが続くためです(例: Aḥmadu zawjī「Ahmad は私の夫です」)。
別の例: 正しい文語アラビア語ではAḥmadu zawjun shirrīr「アフマドは邪悪な夫だ」と発音しなければならない文は、通常は (アラビア語の俗語の影響により) Aḥmad zawj shirrīrと発音されます。しかし、アラビア語の文法と正書法では、これは誤って発音されたものではなく、さらに別の単語が続いているかのように扱われます。つまり、母音記号を追加する場合は、発音がAḥmadu zawjun sharrīrunで、最後にtanwīn 「un」が付いているかのように追加する必要があります。したがって、最後のrにun tanwīn記号を追加するのは正しいですが、実際に発音すると過剰訂正になります。また、実際の発音では(正しいアラビア語では必ず) sukūn ed であるにもかかわらず、そのrにsukūnを書くのは決して正しくありません。
もちろん、正しいi'rābがsukūnである場合は、オプションで記述できます。
ٰٰ sukūn は単語をアラビア文字に音訳するためにも使用されます。たとえば、英語の名前「Mark」はماركと書きますが、 رの上にsukūnを付けて書くと、その文字とكの間に母音がないことがわかります。
追加の文字
地域による違い
一部の文字は、特定の地域では伝統的に異なる形式をとります。
非標準文字から現代標準アラビア語へ
いくつかの修正文字は、現代標準アラビア語の非ネイティブな音を表すために使用されます。これらの文字は、音訳された名前、借用語、方言の単語でオプションの代替として使用されます。これらの文字の使用は、書き手とその出身国によって異なり、使用は必須ではありません。
非標準音素/ ɡ / (エジプトでのみجの標準発音とみなされる) は、標準アラビア語で借用語や外来固有名詞を書くときに最も多くのバリエーションを持ち、標準文字ج、غ、ق、كで書くことも、非標準文字ڨ (チュニジアとアルジェリアでのみ使用)、ڭ (モロッコでのみ使用)、گ (主にイラクで使用) で書くこともできます。たとえば、「Golf 」は/ɡoːlf/と発音され、書き手とその出身国に応じてجولف、غولف、قولف、كولف、ڨولف 、ڭولف、گولفと書くことができます。一方、/ ɡ /は、下エジプト、オマーンの一部、イエメンの一部のようにجの反射音として(例: جمل [gamal] )、またはアラビア半島のほとんど、イラク、スーダン、エジプト、レバント、北アフリカの一部のようにقの反射音として(例: قال [gaːl] ) 、ほとんどのアラビア語方言で土着の音素であると考えられています。
注: / p /と/ v / の音は、ほとんどのアラビア語方言では非ネイティブである(アナトリア語では、ذِئْب「狼」は標準アラビア語[ðɪʔb]ではなくvīp [viːp] [13]と発音される)。一方、/ g /、/ t͡ʃ /、/ ʒ / は多くの方言でネイティブの音素または異音として現れる。
アラビア語以外の言語で使用される
数字
アラビア語のテキストで使用される数字には、主に 2 種類あります。西洋アラビア数字と東洋アラビア数字です。現在の北アフリカのほとんどでは、通常の西洋アラビア数字が使用されています。西洋アラビア数字と同様に、東洋アラビア数字でも、単位は常に右端にあり、最高値は左端にあります。東洋アラビア数字は左から右に書かれます。
文字を数字として
さらに、アラビア語のアルファベットは数字(アブジャド数字)を表すのにも使えます。この用法はアルファベットのアブジャド順序に基づいています。أ ʾalifは1 、 ب bāʾは2、ج jīmは 3 で、 ي yāʾ = 10、ك kāf = 20、ل lām = 30、...、ر rāʾ = 200、...、غ ghayn = 1000まで続きます。これはクロノグラムを作成するのに時々使われます。
歴史

アラビア文字の起源は、ナバテア・アラム語を書くために使われたナバテア文字に遡ります。ナバテア・アラム語とその後のアラビア文字と認識できる文字の間の過渡期は、ナバテア・アラビア文字として知られています。5世紀から6世紀に存在したイスラム以前の文字は、イスラム時代に知られるようになった文字と明らかに類似しており、古アラビア文字として知られています。[17]
アラビア文字で書かれた最古の文献として知られているのは、ヨルダンのアカバから東に50km離れたジャバル・ラムで発見された紀元4世紀後半の碑文だが、シリアで発見された紀元512年のザバド三か国語碑文が最古のアラビア文字である。[18]とはいえ、碑文の記録は極めて乏しい。後に、文字を区別するために文字の上下に点が付けられた。(アラム語の音素はアラビア語よりも少なく、もともと区別がつかなかったアラム語の文字の中には、形で区別がつかなくなったものもあったため、初期の文献では28の音を14の異なる文字形で表現しなければならなかった。同様に曖昧なパフラヴィー語も参照のこと。)
これらの点が確実に使用されている現存する最初の文書は、643 年 4 月の日付が付いた現存する最初のアラビア語パピルス( PERF 558 ) でもありますが、これらの点の使用が義務付けられたのはずっと後になってからでした。重要なテキストは、特にコーランの暗記において、頻繁に暗記されていましたし、今でも暗記されています。
さらに後になって、シリア語とティベリア語の発音が初めて発明される前の 7 世紀後半から、母音記号とハムザが導入されました。最初は赤い点のシステムで行われ、ウマイヤ朝時代のアブ・アル=アスワド・アル=ドゥアリによって命じられたと言われています。上の点 = a、下の点 = i、線上の点 = u、二重の点は数字記号を示していました。しかし、これは扱いにくく、文字を区別する点と混同しやすいため、約 100 年後に現代のシステムが採用されました。このシステムは、786 年頃にアル=ハリール・イブン・アフマド・アル=ファラヒディによって完成されました。
アラビア語方言で書かれたその他の賛辞とアルファベット
現在使用されているアラビア文字が普及する前、アラビア語の方言は異なる文字で書かれていました。これらの文字と碑文の中で最も重要なのはサファイヤ文字の碑文で、レバント砂漠で発見された3万点の碑文に上ります。[19]
ヨルダン中部とアラビア半島北西部にはヒスマイル語 の碑文が約3,700点、ナバテア語の碑文が残っており、その中で最も重要なのはウンム・アル・ジマル1世碑文とヌマラ碑文である。[20]

アラビア語印刷
中世アラビアの版画は10 世紀から 14 世紀にかけて栄えました。版画は主にお守りなどに使われる非常に小さな文字のみに使用されていました。
1450年にヨハネス・グーテンベルクが印刷機を発明した後、1514年にヴェネツィア人のグレゴリオ・デ・グレゴリーがアラビア文字で祈祷書を出版した。それは「Kitab Salat al-Sawa'i 」と題され、東方キリスト教コミュニティ向けに書かれたものだった。[21] 1580年から1586年にかけて、書体デザイナーのロバート・グランジョンがフェルディナンド・デ・メディチ枢機卿のためにアラビア語の書体をデザインし、メディチ東洋出版社は16世紀後半にキリスト教の祈祷書やアラビア語の学術書を多数出版した。[22]

レバノン山のマール・クザイ修道院のマロン派修道士たちは、中東で初めて活版印刷によるアラビア語の本を出版しました。修道士たちは、アラビア語をシリア文字で音訳しました。
ナポレオンは1798年のエジプト侵攻の際に印刷機をエジプトにもたらしたと一般に考えられているが、実際、フランス占領下の公式新聞「アル・タンビヤー(伝令)」を印刷するために印刷機とアラビア語の印刷機を持ち込んだが、アラビア語の印刷はそれより数世紀前に始まっていた。中東では、金細工師(グーテンベルクのような)がアラビア文字の活字印刷機を設計し、実装した。レバノンのメルキト派修道士アブダラ・ザケルは、レバノン山地のドゥール・エル・シュワイルの町にある聖ヨハネ修道院に活字を使ったアラビア語印刷機を設置した。これはレバノンでアラビア文字を使った最初の自家製印刷機であった。彼は自ら活字の型を切り、書体の作成を行った。彼の印刷機で最初の本が出版されたのは1734年で、この印刷機は1899年まで使われ続けた。[23]
コンピューター
アラビア語のアルファベットは、 ISO-8859-6、Windows-1256、Unicodeなどのいくつかの文字セットを使用してエンコードできます。 Unicodeには、「アラビア語セグメント」エントリ U+0600 から U+06FF が含まれます。 ただし、どのセットも、各文字がコンテキスト内でとるべき形式を示していません。各文字に表示する 適切なグリフを選択するのは、レンダリング エンジンに任されています。
各文字は Unicode で位置に依存しないエンコード方式を採用しており、レンダリング ソフトウェアは結合コンテキストから正しいグリフ形式 (先頭、中間、末尾、または単独) を推測できます。これが現在の推奨事項です。ただし、以前の標準との互換性を保つために、先頭、中間、末尾、および単独の形式を個別にエンコードすることもできます。
ユニコード
ユニコード16.0以降、アラビア文字は次のブロックに含まれています: [24]
- アラビア語(0600–06FF、256 文字)
- アラビア語補足(0750~077F、48文字)
- アラビア語拡張A(08A0~08FF、96文字)
- アラビア語拡張B(0870~089F、42文字)
- アラビア語拡張C(10EC0~10EFF、7文字)
- アラビア語プレゼンテーションフォーム A (FB50~FDFF、631 文字)
- アラビア語プレゼンテーションフォーム B (FE70~FEFF、141 文字)
- ルミ数字記号(10E60~10E7F、31文字)
- インド系シヤク数字(1EC70~1ECBF、68文字)
- オスマン帝国のシヤク数字(1ED00~1ED4F、61 文字)
- アラビア語の数学アルファベット記号(1EE00〜1EEFF、143 文字)
アラビア語の基本範囲は、標準の文字と発音区別符号をエンコードしますが、文脈形式はエンコードしません(U+0621-U+0652は直接ISO 8859-6に基づいています)。また、最も一般的な発音区別符号とアラビア語-インド数字も含まれます。U+06D6からU+06EDは、「アーヤの終わり」ۖや「ルブ・エル・ヒズブの開始」۞などのコーランの注釈記号をエンコードします。アラビア語の補足範囲は、主にアフリカ(非アラビア)言語の表記に使用される文字の異形をエンコードします。アラビア語の拡張A範囲は、さまざまな非アラビア言語で使用される追加のコーランの注釈と文字の異形をエンコードします。
アラビア語のプレゼンテーション フォーム A の範囲は、ペルシア語、ウルドゥー語、シンド語、中央アジアの言語に必要な文字の異形の文脈形式と合字をエンコードします。アラビア語のプレゼンテーション フォーム B の範囲は、アラビア語の発音区別符号の間隔形式と、より文脈的な文字形式をエンコードします。アラビア語の数学アルファベット記号ブロックは、アラビア語の数式で使用される文字をエンコードします。
修正文字に関するセクションの注記も参照してください。
キーボード



異なる国向けに設計されたキーボードはレイアウトが異なるため、イラクなどのあるスタイルのキーボードの熟練度は、サウジアラビアなど別のスタイルのキーボードの熟練度には適用されません。相違点には、アルファベット以外の文字の位置などが含まれる場合があります。
すべてのアラビア語キーボードでは、 Web ブラウザーの URL などのローマ字を入力できます。したがって、各アラビア語キーボードのキーにはアラビア語とローマ字の両方がマークされています。通常、アラビア語キーボードのローマ字はQWERTYレイアウトに準拠していますが、フランス語がローマ字を使用して入力される最も一般的な言語である北アフリカでは、アラビア語キーボードはAZERTYです。
文字の特定の書き方をエンコードするために、Unicode には、必要な書き方を正確に表現するために使用できる追加のコード ポイントが用意されています。アラビア語の表示形式 A (U+FB50 から U+FDFF) の範囲には合字が含まれ、アラビア語の表示形式 B (U+FE70 から U+FEFF) の範囲には位置バリアントが含まれます。これらの効果は、ゼロ幅ジョイナーとゼロ幅非ジョイナーを使用することによって Unicode でよりよく実現されます。これらの表示形式は Unicode では非推奨であり、通常はテキスト レンダリング ソフトウェアの内部でのみ、または Unicode を文字エンコード間の変換の中間形式として使用する場合、またはグリフ形式のハードコーディングに依存する実装との下位互換性のためにのみ使用する必要があります。
最後に、アラビア語のユニコードエンコードは論理的な順序で行われます。つまり、文字は、紙や画面に表示される方向を気にすることなく、書き順と発音順に入力され、コンピュータのメモリに保存されます。ここでも、ユニコードの双方向テキスト機能を使用して、レンダリングエンジンが文字を正しい方向に表示します。この点で、このページのアラビア語の単語が左から右に書かれている場合、それを表示するために使用されているユニコードレンダリングエンジンが古くなっていることを示しています。[25] [26]
Yamliエディタなどの競合するオンラインツールでは、PCにアラビア語サポートがインストールされていなくても、またアラビア語キーボードのレイアウトを知らなくてもアラビア語の文字を入力できます。[27]
手書き認識
アラビア語の手書き文字をリアルタイムで識別する世界初のソフトウェア プログラムが、ベングリオン大学(BGU) の研究者によって開発されました。
このプロトタイプでは、ユーザーが電子スクリーンにアラビア語の単語を手書きすると、スクリーンがテキストを分析し、1000分の1秒でアラビア語の文字に変換します。このシステムを修士課程の学生ファディ・ビアドシとともに開発した、BGUのコンピューター科学部のジハード・エルサナ博士によると、エラー率は3%未満です。[28]
バリエーション
参照
注記
- ^ 文字形式の地域的差異に関するセクションを参照してください。
参考文献
- ^ ダニエルズ、ピーター・T. ;ブライト、ウィリアム、編 (1996)。世界の書記体系。オックスフォード大学出版局、p. 559。ISBN 978-0195079937。
- ^ Zitouni, Imed (2014).セム語族の自然言語処理. Springer Science & Business. p. 15. ISBN 978-3642453588。
- ^ abc マクドナルド1986年、117、130、149頁。
- ^ マクドナルド1986年、130ページ。
- ^ (アラビア語) Alyaseer.net ترتيب المداخل والبطاقات في القوائم والفهارس الموضوعية 件名インデックスのエントリとカードの順序付け 2007 年 12 月 23 日にウェイバック マシンにアーカイブディスカッション スレッド(アクセス済み) 2009 年 10 月 – 2006 年)
- ^ ロジャース、ヘンリー (2005)。「書記体系:言語学的アプローチ」ブラックウェル出版。135 ページ。
- ^ Habash, Nizar Y. (2022年6月1日). アラビア語自然言語処理入門. Springer Nature. p. 60. ISBN 978-3-031-02139-8。
- ^ Alhonen, Miikka-Markus. 「アラビア語の結合発音区別符号ワスラのエンコードの提案」(PDF) . unicode.org . 2014年3月25日閲覧。
- ^ Price, James M (2012 年 6 月 7 日)。「補助母音と省略可能なハムザ」。アラビア語レッスン: 初めて学んだアラビア語のすべて。2014年3 月 25 日閲覧。
- ^ 「Unicode におけるアラビア語の合字形式の一覧」。
- ^ 「Scheherazade New」. SIL International . 2022年2月4日閲覧。
- ^ 「アラビア語方言チュートリアル」(PDF) 。 2008年12月17日時点のオリジナル(PDF)からアーカイブ。 2008年12月2日閲覧。
- ^ アクス、ファルク。 「アナトリアのアラビア語」。
- ^ ファイル:Basmala kufi.svg – ウィキメディア・コモンズ
- ^ ファイル:Kufi.jpg – ウィキメディア・コモンズ
- ^ ファイル:Qur'an folio 11th century kufic.jpg – ウィキメディア・コモンズ
- ^ 2020年現在。
- ^ ブレア、シーラ(1998年)。イスラムの碑文。エディンバラ:エディンバラ大学出版局。p. 21。ISBN 0748609032。
- ^ " علم اللغة العربية • الموقع الرسمي للمكتبة الشاملة". 2018年12月15日。2018年12月15日のオリジナルからアーカイブ。2024 年3 月 16 日に取得。
- ^ Al-Jallad、Ahmad (2019 年 1 月 6 日)、アラビア語歴史文法マニュアル – Academia.edu 経由
- ^ “フェデリシアーナ図書館294°周年: キタブ・サラット・アル・サワイの貴重な記録” . 2017 年1 月 31 日に取得。
- ^ ナガシアン、ナギ (2013 年 1 月 21 日)。アラビア文字のデザインと構造。エプブリ。ISBN 9783844245059。
- ^ アラビア語と印刷術 - 特別セクション 2006年12月29日アーカイブ、Wayback Machine、ポール・ルンデ著
- ^ 「UAX #24: スクリプト データ ファイル」。Unicode文字データベース。Unicode コンソーシアム。
- ^ アラビア語のエンコードの詳細については、UnicodeのWebサイトにあるUnicodeマニュアルを参照してください。
- ^ アラビア語とアラビア語の音訳による多言語コンピューティング: Windows アプリケーションをアラビア語の読み書き用にアラビア語化する & アラビア文字言語が直面する音訳の難問に対する解決策および Windows オペレーティング システムにアラビア語を追加する方法に関する PowerPoint チュートリアル (スクリーン ショットと英語のナレーション付き) も参照してください。2011 年 9 月 11 日にWayback Machineにアーカイブされました。
- ^ 「ヤムリのニュース」
- ^ 「イスラエル21c」2007年5月14日。
出典
- マクドナルド、マイケル CA (1986)。「古代北アラビア語の ABC と文字順序」アラビア研究セミナー議事録(16): 101–168。
- ネーメ、ライラ(2020)。 「ナバテア語、ナバテオ・アラビア語、イスラム以前のアラビア語の碑文に反映されたアラビア北西部の宗教的景観」。セミティカとクラシカ。13 : 127–154。土井:10.1484/J.SEC.5.122984。
外部リンク
- Shaalan, Khaled; Raza, Hafsa (2009年8 月)。「NERA: アラビア語の名前付きエンティティ認識」。アメリカ情報科学技術学会誌。60 (8): 1652–1663。doi :10.1002/asi.21090。
