
アラビア文字[ a ]またはアラビア文字は、アラビア語を書くために特別に体系化されたアラビア文字です。これは右から左に筆記体で書かれる一院制の文字で、28文字[ b ]を含み、そのほとんどが文脈によって形が変わります。アラビア文字はアブジャドであり、文字は子音のみを記録します[ c ]。母音を表記するために発音記号を任意で使用するため、不純なアブジャドとみなされます。[ 2 ]
アラビア語の基本アルファベットは28文字で構成され、それぞれの文字は完全な文字または発音記号として機能します。[ 3 ]アラビア文字を使用して他の言語を記述する形式では、文字が追加または削除されています。たとえば、⟨پ⟩はアラビア文字の適応において/p/を表すためによく使用されます。
多くの文字は見た目が似ていますが、中央部分(ラスム)の上または下に点(イジャーム)が付いていることで区別されます。これらの点は、異なる音を表す文字を区別するため、文字の不可欠な部分です。たとえば、アラビア文字のب b、ت t、ث thは基本的な形は同じですが、それぞれ下に 1 つ、上に 2 つ、上に 3 つの点が追加されています。文字ن nも、語頭と語中では上に 1 つの点が追加され、形は同じですが、単独の形と語末の形では多少異なります。歴史的には、ラスムと呼ばれる書き方では、これらの点はしばしば省略されていました。
アラビア語は印刷体も手書き体も筆記体であり、単語内のほとんどの文字は隣接する文字と直接つながっている。
アラビア語のアルファベットは常に筆記体で、文字は単語内の位置によって形が変わります。文字は、語頭、語中、語末、または孤立した位置 ( IMFI ) に対応する最大 4 つの異なる形を示すことができます。一部の文字はかなりの変化を示しますが、他の文字は 4 つの位置すべてでほぼ同じままです。一般的に、同じ単語内の文字は短い水平線で両側で連結されますが、6 つの文字 ( و、ز、ر、ذ、د、ا ) は前の文字とのみ連結できます。さらに、一部の文字の組み合わせは合字(特殊な形) として書かれ、特にlām-alif لا [ 4 ]は唯一の必須合字です (合字のない組み合わせل اは読みにくいと考えられています)。
ハムザ/ ʔ /(声門閉鎖音)は、文字のように単独で書くことも、発音記号となるキャリアーと共に書くことも可能です。[ 5 ]ハムザ・アル・マッド (آ )は、 آسف ʾāsif /ʔaː.sif/ 「ごめんなさい」のように、長い/ ʔ / + /aː/音を示しますが、他のハムザは、مسؤول masʾūl /mas.ʔuːl/ や سائل sāʾil /saː.ʔil/ のように、単語のさまざまな位置で声門閉鎖音 /ʔ/ を示します。ハムザの書き方は一連の規則に基づいています。各形式の書き方の規則については、ハムザ §アラビア語の「座席」規則を参照してください。
以下は個々の文字ではなく、アラビア文字の文脈による異なる異体字です。
コーランなどのテキストに見られる、完全に母音記号が付いたアラビア語のテキストでは、ハムザ以外の子音の後に続く長母音āは、子音の上に短いa記号 (ファトハ) を付け、その後にʾalif を付けて書きます。長母音īは、短いi (カスラ)の記号にyāʾを付けて書き、長母音ū は、短いu (ダンマ)の記号にwāwを付けて書きます。簡単に言うと、ᵃa = ā、ⁱy = ī、ᵘw = ūです。ハムザの後に続く長母音 ā は、 ʾalif maddahまたはʾalifの後に続く自由なハムザで表すことができます。アラビア語では、2 つのʾalifが連続することはありません。
下の表は、主要な子音文字またはシャッダ記号の代わりに点線の円の上または下に配置された母音を示しています。表を分かりやすくするために、これらの長母音を示すために使用される左側の主要な文字は、単独の形でのみ表示されています。ほとんどの子音は、左側のʾalif、wāw、yāʾに接続し、中間形または末尾形で書きます。さらに、最後の行の文字yāʾ は、左側の文字に接続し、中間形または頭形を使用します。主要な文字の表を使用して、実際の代表的なグリフと接続タイプを確認してください。
母音記号のないテキスト(短母音が表記されていないテキスト)では、長母音は該当する母音、すなわちʾalif mamdūdah/maqṣūrah、wāw、またはyāʾで表されます。母音記号のないテキストの単語の中央に書かれた長母音は、完全な発音記号のあるテキストでは、スクーン(下記参照)が付いた子音と同様に扱われます。ここでも、表では分かりやすさのために長母音の文字は単独で表示されています。
واとيا の組み合わせは、それぞれwāとyāと発音されます。例外は、動詞の語尾にある接尾辞ـوا۟で、この場合ʾalif は発音されず、ūまたはawとなります。さらに、アラビア語話者は、名前や外来語を音訳する際に、ほとんどまたはすべての母音を長母音として書きます ( āにはا ʾalif、ēとīにはي yaʾ、ōとūにはو wāw )。これは、アラビア語が真のアルファベットに近いことを意味します。
二重母音حروف اللين ḥururufu l-līn /aj/および/aw/は、音声化されたテキストでは次のように表されます。
最後のyaʾは通常、ニスバ( اَلنِّسْبَة nisbah )の語尾に書かれます。これは、関係性または関連性の形容詞を形成する一般的な接尾辞です。接尾辞は男性の場合はـِيّ -iyy (女性の場合はـِيَّة -iyya(t)- ) です。たとえば、اِشْتِرَاكِيّ ištirākiyy は「社会主義者」ですが、 جندي jundiyyの「兵士」のように、人間またはその他の感覚を持った存在に適用される単数形の語尾にも使用されます。しかし現在では、この最後のyaʾ は、اِشْتِرَاكِيّ ištirākiyyではなく、اِشْتِرَاكِي ištirākī /iʃtiraːkiː/のように、 長いyaʾ ( yāʾ mamdōdah ) -īで発音されることがほとんどです。 /iʃtiraːkijj/。同様の間違いは、今日ではجَرُوا jaru /d͡ʒaruː/と発音されるجَرَوْا jaraw 「彼らは走った」のように、一部の三人称複数動詞の語尾で発生します。

アラビア語では合字の使用が一般的です。必須の合字は、lām ل + alif ا の合字で、2 つの形式があります。その他多くの合字[ 7 ]はすべて任意です。

7つの異なる要素を組み合わせた、より複雑な合字が、一般的に「アッラー」( الله)という単語を表すのに使われます。Unicode (U+06xx)のアラビア文字の主要範囲に含まれる合字は、ラーム+アリフのみです。これはフォントやワープロソフトで必須となる唯一の合字です。その他の範囲は、古い規格との互換性を保つためのもので、オプションの合字が含まれています。
注: Unicodeのプレゼンテーション形式 B FExx 範囲にもこの合字のコードがあります。ブラウザとフォントがアラビア語用に正しく設定されていれば、上に表示されている合字はこれと同じになります。U+FEFB
アラビア語のアルファベットには、主に2つの照合順序(「アルファベット順」)があります。それは、ヒジャイとアブジャディです。
ヒジャーイ順序(هِجَائِيّ Hijāʾiyy /hid͡ʒaːʔijj/)はより一般的な順序であり、電話帳、教室のリスト、辞書などの単語や名前のリストを並べ替えるときに使用されます。
本来のアブジャディ文字の順序(أَبْجَدِيّ ʾabjadiyy /ʔabd͡ʒadijj/ )はフェニキア文字で使用されている順序に由来するため、ヘブライ語やギリシャ語の文字の順序に似ています。また、ヘブライ語のゲマトリアやギリシャ語のイソプセフィーと同様に、数秘術の目的で文字に数値(アブジャド数)が割り当てられます。ヒジャイ文字の順序では、文字に数値は割り当てられません。
現代の辞書や参考書では、文字を主に形状の類似性に基づいて並べるアブジャディ式アルファベット順ではなく、ヒジャーイー式アルファベット順が用いられています。ヒジャーイー式は数字には決して使用されません。
マグリブでは別のヒジャーイの順序が使われていましたが、現在は廃れています。その順序は次のとおりです。[ 8 ]
現在では廃れてしまったアル・イクリールの順序も、主に形に基づいて文字を並べたものでした。これは10世紀の著作『キターブ・アル・イクリール』で初めて使用されました。その順序は次のとおりです。[ 9 ]

アブジャディ順序は、1 千年紀後半から 2 千年紀前半にかけての辞書や参考書で一般的に用いられていたアラビア語の順序です。しかし、このアラビア語のアブジャディ順序は、それ以前の北セム語のアルファベット順序と単純に対応しているわけではありません。なぜなら、後者にはアラム語の文字サメク𐡎 に対応する位置があり、歴史的にアラビア語のアルファベットには同族の文字が存在しないからです。これは、原セム語の摩擦音*š (アラム語ではšin 𐡔で表される[注 1 ] ) と*s (アラム語ではsamek 𐡎 で表される[注 2 ] ) がアラビア語のs سに融合し[ 10 ] [ 11 ] 、原セム語の*śがアラビア語のš شになったためです。
サメクの損失は補償された。
北セム語のどの文字にも対応しない残りの6文字は、末尾に配置される。
これは一般的に次のように発音されます。
別の発音は次のとおりです。
これは次のように発音できます。
注:
アラビア語話者は通常、長母音は表記しますが短母音は省略するため、読者はアラビア語の知識を駆使して省略された母音を補う必要があります。しかし、教育制度、特にアラビア語文法の授業では、これらの母音は文法上非常に重要であるため使用されます。アラビア語の文は、母音の微妙な変化によって全く異なる意味を持つことがあります。そのため、コーランのような重要なテキストでは、アラビア語の発音記号や朗唱記号などの他の種類の記号と同様に、3つの基本的な母音記号が義務付けられています。
日常的に使われるアラビア語の手書き文字、一般出版物、街路標識などでは、短母音は通常表記されません。一方、コーランの写本は、発音記号が含まれていない限り、審査を行う宗教機関によって承認されることはありません。児童書、小学校の教科書、そして一般的なアラビア語文法書には、ある程度発音記号が含まれています。これらは「母音付き」テキストとして知られています。
短母音は、音節内の先行する子音の上または下に、ḥarakātと呼ばれる発音記号を付けて表記されることがあります。アラビア語の母音はすべて、長母音も短母音も子音の後に続きます。アラビア語では、たとえば「Ali」や「alif」のような単語は子音で始まります: 'Aliyy、alif。
ヌネーション(アラビア語: تنوين Tanwīn ) は、名詞または形容詞に最後の-nを追加することです。前の母音は文法上の大文字と小文字を示します。アラビア語の書き言葉では、母音発音は単語の末尾にある母音発音記号を 2 つ重ねることによって示されます (例: شُكْرًا šukr an [ ʃukran ] ' Thank you ' )。
子音の重子音化とは、子音が二重になることを指します。アラビア語では、文字を二重に書く代わりに、その上にシャッダと呼ばれるW字型の記号を付けます。
アラビア語の音節は、開音節(母音で終わる)と閉音節(子音で終わる)に分類されます。
通常のテキストは、子音と母音を長くする文字のみで構成されています。したがって、「心」を意味するqalbという単語はqlbと書かれ、 「彼は振り返った」を意味するqalaba という単語もqlbと書かれます。この曖昧さをなくしてqalaba を書くには、 lの後に短いaが続くことを示すために、l の上にファトハを書けばよいでしょう。
qalbと書くには、代わりにsukūnと呼ばれる発音記号でlの後に母音が続かないことを示します( ْ)、このように: قلْب 。これは、 qの後の母音もファトハで示される完全な母音化から一段階下がったものです: قَلْب。
クルアーンは伝統的に、完全な母音記号を用いて書かれている。
クルアーンの版によっては、長母音のiはカスラに続いて発音記号のないyで表記され、長母音のu はダンマに続いて発音記号のないwで表記される。他の版では、これらのyとwにはスクーンが付く。クルアーン以外では、後者の表記法は極めてまれであり、スクーン付きのy は二重母音/aj/と明確に読み、スクーン付きのw は/aw/と読みます。
例えば、文字myl は英語のmealやmailのように読むことができ、また (理論的には) mayyalやmayilのように読むこともできます。しかし、yにsukūnが追加されると、 mにはsukūnが付きません(連続する 2 文字にsukūnを付けることができないため)、ḍammahも付きません( yの後に別の母音がない限り、アラビア語にはuy の音はありません)、kasrahも付きません( sukūn が付いたyの前にkasrah があることはコーラン以外では見られないため)。そのため、fatḥah が付き、唯一可能な発音は/majl/ (mile または e-mail を意味します) となります。同様に、yの上にスクーンが付いた myt はmayt にはなり得ますがmayyitやmeetにはなり得ません。また、 wの上にスクーンが付いた mwt はmawt にしかなり得ず、moot にはなり得ません( w が音節を閉じる場合、 iwは不可能です)。
母音記号は、実際の発音では省略しなければならない場合でも、イラーブ母音が実際に発音されるかのように常に表記されます。したがって、 Aḥmadという名前を書く場合、 ḥにスクーンを付けることは任意ですが、dにスクーンを付けることは禁じられています。なぜなら、 Aḥmadu zawjī 「アフマドは私の夫です」のように、後に別の単語が続くと、 d にダンマが付くことになるからです。
もう一つの例として、正しい文体アラビア語では「アフマドは邪悪な夫だ」と発音されるべき文が、(口語アラビア語の影響で)通常は「アフマド・ザウジュン・シッリール」と発音されます。しかし、アラビア語の文法と正書法においては、この文は誤って発音されたのではなく、さらに別の単語が続くものとして扱われます。つまり、母音記号を追加する場合は、最後にタンウィン「ウン」が付いた「アフマド・ザウジュン・シャッリールン」として発音されるものとして追加する必要があります。したがって、最後の「r」にタンウィン「ウン」を追加するのは正しいのですが、実際にそれを発音するのは過剰修正となります。また、実際の発音では sukūn ed であるにもかかわらず (そして正しいアラビア語では必ずsukūn ed でなければならない)、そのrにsukūnと書くことは決して正しくありません。
もちろん、正しいイラーブがスクーンである場合は、任意で記述してもよい。
スクーンは、単語をアラビア文字に音訳する際にも使用されます。たとえば、英語名「Mark」はماركと書かれますが、これはرの上にスクーンを付けて、その文字とكの間に母音がないことを示している場合があります。
これらの発音記号は現代の出版物ではあまり見られないが、コーランや一部の写本ではよく使われている。
ٰアリフ・ハンジャリーヤ ( أَلِف خَنْجَرِيَّة、「短剣 'alif'」) は、文字の上に短い垂直ストロークで書かれます。これは、 alifが通常書かれない長い/aː/音を示します。例: ⟨ هٰذَا ⟩ ( hādhā ) または⟨ رَحْمٰن ⟩ ( raḥmān )。
ワスラまたはハムザット・アル=ワスル(هَمْزَةُ ٱلْوَصْلِ、「接続のハムザ」 )は、文字ء ؟ � の異形で、文字ṣād(ص)の一部に似ており、まれに文字ʾalif (أَلِف ٱلْوَصْلِ ʾalif al-waṣl(ا ))の上に置かれて、単語の先頭で( ٱ )を形成します。これは、ʾalifが声門閉鎖音(ハムザとして表記される)として発音されず、単語が前の単語とつながっている(フランス語のリエゾンのように)ことを示しています。音声化された典礼文書以外には、通常、ワーシュラは書かれません。[ 13 ] [ 14 ]たとえば、Abdullah عَبْدُ ٱللّٰهِは、 ٱللهという単語の最初の文字に hamzat al-wasl を付けて書くこともできますが、ほとんどの場合、それなしでعَبْدُ اللّٰهِと書かれます。
地域によっては、文字の形が伝統的に異なる場合がある。
現代標準アラビア語にはない音を表すために、一部の特殊文字が用いられます。これらの文字は、音訳された名前、外来語、方言語において、任意で代替として使用されます。これらの文字の使用は、書き手とその出身国によって異なり、必ずしも使用されるとは限りません。
音素/ ɡ / (エジプト、オマーン、イエメン沿岸部ではجの標準的な発音と考えられている) は、文語アラビア語で外来語や外国固有名詞を書く際に最も多くのバリエーションがあり、標準文字ج、غ、ق、كまたは非標準文字ڨ (チュニジアとアルジェリアでのみ使用)、ڭ (モロッコでのみ使用)、گ (主にイラクで使用) のいずれかで書くことができます。たとえば、「Golf 」は/ɡolf/と発音され、書き手とその出身国によってجولف、غولف、قولف、كولف、ڨولف 、ڭولف、گولفと書くことができます。一方、/ ɡ /は、ほとんどのアラビア語方言で固有の音素と考えられており、下エジプト、オマーンの一部、イエメンの一部ではجの反映として(例: جمل [ ˈɡæmæl ] ) 、アラビア半島の大部分、イラク、スーダン、エジプト、レバント、北アフリカの一部ではقの反映として(例: قال [ ɡæːl, ɡɑːl ])用いられています。
注: / p /と/ v /の音はほとんどのアラビア語方言には固有ではありません (標準アラビア語の[ ðɪʔb ]の代わりにذِئْب "wolf" が vīp [viːp] [ 16 ]と発音されるアナトリアアラビア語を除く)。一方、/ g /、/ t͡ʃ /、/ ʒ /は多くの方言で固有音素または異音として現れます。
アラビア語のテキストとともに使用される数字には、主に2種類あります。西アラビア数字と東アラビア数字です。現在の北アフリカのほとんどの地域では、一般的な西アラビア数字が使用されています。西アラビア数字と同様に、東アラビア数字でも、一の位は常に右端にあり、最も高い値は左端にあります。東アラビア数字は左から右に書きます。

さらに、アラビア文字は数字を表すためにも使用できます(アブジャド数字)。この使用法は、アルファベットのアブジャディー順序に基づいています。أ ʾalifは1、ب bāʾは 2、ج jīmは 3 であり、ي yāʾ = 10、ك kāf = 20、ل lām = 30、...、ر rāʾ = 200、...、غ ghayn = 1000 まで続きます。これは、クロノグラムを作成するために使用されることがあります。

アラビア文字は、ナバテア・アラム語の表記に使われていたナバテア文字に遡ることができます。ナバテア・アラム文字と、その後のアラビア文字と認識できる文字との間の過渡期は、ナバテア・アラビア語として知られています。5世紀から6世紀にかけて存在した、イスラム以前の文字の段階は、イスラム時代に知られるようになった文字と認識できるほど似てきた後、古アラビア語として知られています。[ 20 ]
アラビア文字で書かれた最古の文書は、ヨルダンのアカバの東50kmにあるジャバル・ラムの4世紀後半の碑文だが、ザバド三言語碑文は512年のもので、シリアで発見された最古のアラビア語文書である。[ 21 ]それにもかかわらず、碑文の記録は極めて乏しい。後に、文字を区別するために文字の上と下に点が加えられた。(アラム語はアラビア語よりも音素が少なく、元々は区別されていたアラム語の文字の中には、形が区別できなくなったものもあった。
これらの点が確実に使用されている現存する最初の文書は、現存する最初のアラビア語パピルス(PERF 558 )でもあり、643年4月の日付が付けられていますが、これらが義務化されたのはずっと後のことです。重要なテキストは、特にコーランの暗記において、当時も今も頻繁に暗記されています。
さらに後になって、7世紀後半のある時期に母音記号とハムザが導入され、シリア語とティベリア語の母音記号の最初の発明に先立つようになりました。当初、これは赤い点のシステムによって行われ、ウマイヤ朝時代にアブー・アル=アスワド・アル=ドゥアリーによって依頼されたと言われています。上の点 = a、下の点 = i、線上の点 = u、二重の点はヌナションを示していました。しかし、これは扱いにくく、文字を区別する点と混同しやすいため、約100年後に現代のシステムが採用されました。このシステムは786年頃にアル=ハリール・イブン・アフマド・アル=ファラヒディによって完成されました。

現在使用されているアラビア文字が普及する以前は、アラビア語の方言はさまざまな文字で書かれていました。これらの文字と碑文の中で最も重要なのは、レバント砂漠で発見された3万点の碑文からなるサファイト文字です。[ 22 ]
ヨルダン中央部とアラビア半島の北西部には、ヒスマイック語の碑文が約3,700点あり、ナバテア語の碑文も存在する。その中で最も重要なのは、ウム・アル=ジマル1世碑文とヌマラ碑文である。[ 23 ]

中世アラビアの木版印刷は、 10 世紀から 1444 年まで、アル・アンダルスからペルシャまで広く栄えた。木版や錫版を用いて、主に護符や魔除けの印刷に用いられ、コーランの詩句(特にムカッタアト)、祈祷文、数秘術、魔術的なシンボルなどが描かれた。クーフィー体、ナスフ体、時にはマグリブ体など、様々なアラビア文字が用いられ、しばしば非常に装飾的で花模様が施されていた。文字の大きさは 3cm からわずか 0.1cm という極小サイズまで様々で、驚くべき技術的成果であった。[ 24 ]
それは護符だけに限定されず、イスラム帝国で使用されました。ファーティマ朝は税金領収書に、アイユーブ朝とマムルーク朝は記念碑的なハッジ証明書に、アルモハド朝は国家布告に、イルハン朝は紙幣に、グラナダ首長国はアルメリアで商業商品に印鑑を押すのに使用しました。しかし、1436年または1444年以降、タルシュの使用は説明もなくイスラム世界から消えました。[ 25 ]

1514年、ヨハネス・グーテンベルクが1450年に印刷機を発明した後、ヴェネツィア人のグレゴリオ・デ・グレゴリーはアラビア文字で書かれた時祷書を出版した。これは『キタブ・サラート・アル・サワイ』と題され、東方キリスト教共同体向けに書かれたものであった。[ 26 ] 1580年から1586年の間に、タイプデザイナーのロベール・グランジョンはフェルディナンド・デ・メディチ枢機卿のためにアラビア語の書体をデザインし、メディチ・オリエンタル・プレスは16世紀後半に多くのキリスト教の祈祷書や学術的なアラビア語のテキストを出版した。[ 27 ]レバノン山のコザヤ修道院のマロン派修道士たちは、中東で初めて活版印刷を用いたアラビア語の本を出版した。修道士たちは、通常キリスト教徒が行うシリア文字を用いたアラビア語の書き方であるガルシュニを採用した。
ナポレオンは1798年のエジプト侵攻時に印刷機をエジプトに導入したと一般的に評価されているが、実際にフランス占領下の公式新聞「アル・タンビヤ」(「通信人」)を印刷するために印刷機とアラビア語印刷機を持ち込んだものの、アラビア語での印刷はそれより数世紀前に始まっていた。グーテンベルクのような金細工師が中東でアラビア文字の活版印刷機を設計し、実用化した。レバノンのメルキト派の修道士アブダラ・ザケルは、レバノン山地のドゥール・エル・シュワイールにある聖ヨハネ修道院で活版印刷機を使ったアラビア語印刷機を設置した。これはレバノンでアラビア文字を使った最初の自家製印刷機だった。彼は活字型を彫り、書体を確立した。最初の本は1734年に彼の印刷機から出版され、この印刷機は1899年まで使われ続けた。[ 28 ]
アラビア文字は、 ISO-8859-6、Windows-1256、Unicodeなど、複数の文字セットを使用してエンコードできます。Unicodeには、U+0600からU+06FFまでの「アラビア語セグメント」が含まれています。しかし、これらの文字セットはいずれも、各文字が文脈に応じてどのような形をとるべきかを示していません。各文字に対して適切なグリフをコンピュータフォントから選択して表示するのは、レンダリングエンジンの役割となります。
各文字(グラフェム)はUnicodeにおいて位置に依存しないエンコーディングを持ち、レンダリングソフトウェアは結合コンテキストから正しいグリフ形式(語頭、語中、語末、または孤立)を推測できます。これが現在の推奨事項です。ただし、以前の規格との互換性を保つため、語頭、語中、語末、および孤立形式を個別にエンコードすることも可能です。
Unicode 17.0の時点では、アラビア文字は次のブロックに含まれています: [ 29 ]
基本アラビア語範囲は、標準的な文字と発音記号をエンコードしますが、文脈形式はエンコードしません(U+0621~U+0652はISO 8859-6に直接基づいています)。また、最も一般的な発音記号とアラビア語インド数字も含まれています。U+06D6~U+06EDは、「節の終わり」などのコーランの注釈記号をエンコードします。ۖそして「 rubʿ al-ḥizbの開始」۞アラビア語補助文字範囲は、主にアフリカ(アラビア語以外)の言語の表記に使用される文字の異形を符号化しています。アラビア語拡張A文字範囲は、コーランの注釈や、さまざまなアラビア語以外の言語で使用される文字の異形を追加で符号化しています。
アラビア語表記形式Aの範囲は、ペルシア語、ウルドゥー語、シンド語、中央アジア諸語に必要な文字の異体字の文脈に応じた形式と合字を符号化します。アラビア語表記形式Bの範囲は、アラビア語の発音記号の間隔形式と、より多くの文脈に応じた文字形式を符号化します。アラビア語数式記号ブロックは、アラビア語の数式で使用される文字を符号化します。
修正文字に関するセクションの注釈も参照してください。



国によってキーボードのレイアウトが異なるため、イラクのキーボードのような特定のスタイルのキーボードに習熟していても、サウジアラビアのキーボードのような別のスタイルのキーボードに習熟できるとは限りません。違いには、アルファベット以外の文字の位置なども含まれます。
アラビア語キーボードはすべて、ウェブブラウザのURL入力など、ローマ字の入力に対応しています。そのため、各アラビア語キーボードには、アラビア文字とローマ字の両方がキーに印字されています。通常、アラビア語キーボードのローマ字配列はQWERTY配列ですが、ローマ字を使用して入力される最も一般的な言語がフランス語である北アフリカでは、アラビア語キーボードはAZERTY配列になっています。
特定の文字の書き方をエンコードするために、Unicode には、目的の書き方を正確に表現するために使用できる追加のコード ポイントが用意されています。アラビア語表示形式 A (U+FB50 ~ U+FDFF) の範囲には合字が含まれ、アラビア語表示形式 B (U+FE70 ~ U+FEFF) の範囲には位置によるバリアントが含まれます。これらの表示形式は Unicode では非推奨となっているため、一般的にはテキスト レンダリング ソフトウェアの内部、文字エンコーディング間の変換の中間形式として Unicode を使用する場合、またはグリフ 形式のハード コーディングに依存する実装との下位互換性のためにのみ使用すべきであり、これらの効果は、ゼロ幅結合子とゼロ幅非結合子を使用することで Unicode でより適切に実現できます。
最後に、アラビア語の Unicode エンコーディングは論理的な順序で行われます。つまり、文字は、紙や画面に表示される方向を気にすることなく、書かれたり発音されたりする順序で入力され、コンピュータのメモリに格納されます。ここでも、Unicode の双方向テキスト機能を使用して、文字を正しい方向に表示するのはレンダリング エンジンに任されています。この点において、このページのアラビア語が左から右に書かれている場合、それは、それらを表示するために使用されている Unicode レンダリング エンジンが古いことを示しています。[ 30 ] [ 31 ]
競合するオンラインツールとして、例えば Yamli エディタなどがあり、PC にアラビア語サポートがインストールされていなくても、またアラビア語キーボードのレイアウトを知らなくてもアラビア語の文字を入力できる。[ 32 ]