2011年、パリのエリゼ宮殿 で開催されたリビア和平会議に出席した各国の国旗。開催国フランス、その左にある欧州、右にある国連の国旗(中央)を除く各国の国旗は、フランス語のアルファベット順に並べられている。ドイツ 、ベルギー 、カナダ 、デンマーク 、アラブ首長国連邦 、 スペイン、 アメリカ合衆国、 ギリシャ、 イラク、イタリア 、ヨルダン 、モロッコ 、ノルウェー 、オランダ 、ポーランド 、カタール 、イギリス 。最後のアラブ連盟 は国ではないため、横に配置されている。アルファベット順とは、特定の アルファベット の順序に基づいて文字列 を並べるシステムです。これは照合 方法の一つです。数学 においては、辞書順とは 、アルファベット順を数値のシーケンスやその他の順序付けられた 数学的対象 など、他のデータ型に一般化したものです。
アルファベット文字に加えて、数字、数値、またはより複雑なタイプの要素を含む可能性のある文字列またはシーケンスに適用される場合、アルファベット順は一般に 辞書順 と呼ばれます。
2つの文字列をアルファベット順に並べる際に、どちらが先に来るかを判断するには、それぞれの文字列の最初の文字 を比較します。最初の文字が異なる場合は、アルファベット順で最初の文字が先に来る文字列が先に来ます。最初の文字が同じ場合は、2番目の文字を比較し、以下同様に比較を続けます。一方の文字列には比較する文字がもうなく、もう一方の文字列にはまだある場合、文字数の少ない方の文字列がアルファベット順で先に来るとみなされます。
アルファベット順においては、大文字は対応する小文字と同一とみなされるのが一般的ですが、文字列の大文字・小文字のみが異なる場合に対処するための慣例が採用されることもあります。また、 スペース、 発音 記号などの特殊文字、句読点 などの非文字を含む文字列の扱いについても、様々な慣例が存在します。
単語や文字列をアルファベット順に並べると、同じ文字で始まる文字列はすべてグループ化され、そのグループ内では同じ2文字の並びで始まる単語はすべてグループ化される、といった具合に、隣接する単語間で共通の頭文字の数を最大化する傾向があります。
ラテン文字での注文
基本的な手順と例 現代のISO基本ラテンアルファベット の標準的な順序は次のとおりです。
ABCDEFGHIJKLMNOPQRSTU-VWXYZ 以下に、単純なアルファベット順の例を示します。
アスター、アストロラーベ、天文学、天体物理学、アト、アタマン、攻撃、バー 別の例:
上記の単語はアルファベット順に並べられています。AsはAster より前に来ます。なぜなら、 As と Aster は同じ 2 文字で始まり、As に はそれ以降の文字がなく、 Aster にはそれ以降の文字があるからです。次の 3 つの単語はAster の後に来ます。なぜなら、それらの 4 文字目 (初めて異なる文字) はr であり、アルファベット順でe ( Aster の 4 文字目)の後に来るからです。これらの単語自体は、6 文字目 (それぞれl 、n 、p ) に基づいて並べられています。次にAt が 来ますが、これは前の単語とは 2 文字目 ( s の後にt が来る) が異なります。Atamanは、 Aster が As の後に来たのと同じ理由でAt の後に来ます。Attackは、3 文字目を比較して Ataman の後に来、Baa は 最初の文字が異なるため、他のすべての単語の後に来ます。
複数単語文字列の処理 順序付け対象の文字列の一部が複数の単語で構成されている場合、つまり、スペースや ハイフン などの区切り文字が含まれている場合、2つの基本的なアプローチが考えられます。最初のアプローチでは、すべての文字列は最初に最初の単語に基づいて順序付けられます。その順序は次のようになります。
オーク、オークヒル、オークリッジ、オークリーパーク、オークリーリバー ここで、 Oak という単語で始まるすべての文字列は、Oakley で始まるすべての文字列よりも前に来る。なぜなら、アルファベット順ではOak が Oakley より前に来るからである。2番目の方法では、文字列はスペースやハイフンがないものとしてアルファベット順に並べられ、[ b ] 次のシーケンスが得られます。
オーク、オークヒル、オークリーパーク、オークリーリバー、オークリッジ ここで、Oak Ridge は Oakley の 弦の後に来るようになり、まるで「Oakridge」と書かれているかのようになります。 2番目の方法は、辞書でよく採用される方法であり、出版社 では辞書順 と呼ばれることが多い。[ c ] 1番目の方法は、書籍の索引でよく使われてきたが、従来は各出版社がどの方法を使うかについて独自の基準を設けていた。1975年以前には、書籍の索引に関するISO規格( ISO 999 )は存在しなかった。
特別なケース
修正された文字 フランス語では、発音記号 が付いた文字などの修飾文字は、アルファベット順の順序付けにおいては基本文字と同じように扱われます。例えば、rôle は rock とrose の間に入り、 role と書かれたものとみなされます。ただし、このような文字を体系的に使用する言語では、一般的に独自の順序付け規則があります。詳しくは、下記の「 言語固有の慣例」 をご覧ください。
姓で並べ替える 姓 が名 の後に書かれる文化圏のほとんどでは、電話帳などの名前リストを姓で最初に並べ替えることが依然として望まれています。この場合、正しく並べ替えるためには名前の順序を変更する必要があります。たとえば、Juan Hernandes と Brian O'Leary は、たとえそのように書かれていなくても、「Hernandes, Juan」と「O'Leary, Brian」として並べ替える必要があります。このルールをコンピュータの照合アルゴリズムに取り込むのは複雑で、単純な試みではうまくいきません。たとえば、アルゴリズムが姓の広範なリストを利用できる場合を除き、「Gillian Lucille van der Waal」が「van der Waal, Gillian Lucille」、「Waal, Gillian Lucille van der」、あるいは「Lucille van der Waal, Gillian」のどれであるかを判断する方法はありません。
姓による順序付けは、学術的な文脈ではよく見られます。複数の著者による単一の論文内では、逆年功序列や論文への貢献度といった他の方法ではなく、姓のアルファベット順に著者を並べることは、「同様の貢献を認める」または「共同研究グループ内の不和を避ける」方法と見なされています。[ 13 ] 特定の分野では、参考文献リストの引用を 著者の姓で並べる慣習により、アルファベット順で先に現れる姓の著者に有利なバイアスが生じることがわかっていますが、参考文献リストが時系列順に並べられている分野では、このような影響は見られません。[ 14 ]
その他 一般的な単語フレーズが「the」、「a」、「an」などの非常に一般的な単語(文法では冠詞 と呼ばれる)で始まる場合、その単語は無視されるか、フレーズの末尾に移動されることがあります。しかし、常にそうとは限りません。たとえば、書籍「The Shining 」は「Shining」または「Shining, The」として扱われ、書籍タイトル「Summer of Sam 」の前に来る可能性があります。しかし、単に「The Shining」として扱われ、「Summer of Sam」の後に置かれる場合もあります。同様に、「A Wrinkle in Time 」は「Wrinkle in Time」、「Wrinkle in Time, A」、または「A Wrinkle in Time」として扱われる可能性があります。これら3つのアルファベット順の方法は、アルゴリズムで比較的簡単に作成できますが、多くのプログラムは代わりに単純な辞書順の順序 に依存しています。
Macの プレフィックスアイルランドやスコットランドの姓によく見られる接頭辞M とMcは Mac の略語であり、綴りがMac であるかのようにアルファベット順に並べられることがあります。そのため、McKinleyは Mackintosh よりも前に記載されることがあります(これは、MacKinleyと綴った場合と同じです)。コンピューターによるソートリストの登場以来、このようなアルファベット順の並べ方はあまり見られなくなりましたが、イギリスの電話帳では今でも使われています。
St 接頭辞接頭辞「St 」または「St.」 は「Saint」の略語であり、伝統的に「Saint」 をフルネームとしてアルファベット順に並べられます。そのため、地名辞典では「St John's」が 「Salem」 よりも前に記載されることがあります(「Saint John's」とフルネームで記載された場合と同様です)。コンピューターによるソートリストの登場以来、このようなアルファベット順の並べ方はあまり見られなくなりましたが、今でも時折用いられています。
数字の扱い方 文字列に数字 (またはその他の文字以外の文字)が含まれる場合、さまざまなアプローチが可能です。そのような文字は、アルファベットのすべての文字の前または後に来るものとして扱われることがあります。別の方法として、数字を綴り通りにアルファベット順にソートする方法があります。たとえば、1776 は 「seventeen seventy-six」と綴ったものとしてソートされ、24 heures du Mans は 「vingt-quatre...」(フランス語で「24」)と綴ったものとしてソートされます。数字やその他の記号が、文字の特別なグラフィック形式として使用される場合(leet の1337 や映画Seven ( Se7en とスタイル化)など)、それらは文字であるかのようにソートされることがあります。自然ソート順は 、文字列をアルファベット順に並べますが、複数桁の数字は単一の文字として扱われ、桁によってエンコードされた数値の値によってソートされます。
君主 や教皇 の場合、その番号はローマ数字 で文字に似ていますが、通常は番号順に並べられます。例えば、VはIの後に来ますが、デンマーク王クリスチャン9世は前任者の クリスチャン8世 の後に来ます。
言語固有の慣習 拡張ラテン文字 を使用する言語は、一般的に追加文字の扱いに関して独自の慣習を持っています。また、一部の言語では、照合の目的で特定の二重音字が 単一の文字として扱われます。たとえば、スペイン語のアルファベットでは、 ñ は n に続く基本文字として扱われ、以前は二重音字ch とll はそれぞれ c とl に続く基本文字として扱われていました。現在、ch とllは 2 文字の組み合わせとしてアルファベット順になっています。新しいアルファベット順の規則は、1994 年に スペイン王立アカデミー によって発行されました。これらの二重音字は、以前は正式には文字として指定されていましたが、2010 年以降はそうではなくなりました。一方、二重音字rrは予想どおり rqu に続きます(1994 年のアルファベット順の規則以前からそうでした)。一方、鋭アクセント付き母音 ( á、é、í、ó、ú ) は常に基本文字と並列に並べられており、文字ü も同様です。
アラビア語 やキオワ語 など、ごく一部の言語では、アルファベットの順序が完全に変更されている。
様々な言語で適用されるアルファベット順の規則を以下に示します。
アラビア語 では、現在使用されている28文字のアルファベット には主に2つの順序があります。標準的で最も一般的なのは、初期のアラビア語学者ナスル・イブン・アシム・アル=ライシーによって考案された ヒジャーイー 順序です。これは、文字をその形状に基づいて並べる視覚的な順序付け方法を特徴としています。例えば、バー (ب)、ター (ت)、サー (ث)は、同じ基本形状またはラスム(ٮ)を持つためグループ化され、 イジャーム と呼ばれる子音のアクセントによってのみ区別されます。他のセム語 やラテン語の音韻に類似したオリジナルのアブジャディー 順序は、現在でも使用されていますが、通常は文書内のリストをローマ数字 に類似した順序付けに限定されています。アブジャディー 順序が番号付けに使用される場合、文字は単語で使用される文字や数字と区別するために修正された形で書かれます。例えば、東アラビア数字の 1(١)と全く同じように見えるアリフ (ا)は、文字の下部から時計回りに小さな楕円形のループが伸び、その後に短い尾(𞺀)が続きます。これらの文字はデジタルではめったに使用されませんが、Unicodeではアラビア数学アルファベット記号 の下にエンコードされています。[ 15 ] あまり一般的ではない順序であるṣawtī 順序は、音声的に照合され、アル=ハリール・イブン・アフマド・アル=ファラヒディ によって作成されました。アゼルバイジャン語 には、標準ラテン文字に加えて 8 つの文字があります。そのうち 5 つは母音で、i、ı、ö、ü、ə であり、3 つは子音で、ç、ş、ğ です。アルファベットはトルコ語 と同じで、同じ文字で同じ音が表記されますが、トルコ語には存在しない音を表す 3 つの追加文字 q、x、ə があります。すべての「トルコ文字」はトルコ語と同様に「通常の」アルファベット順に並べられますが、3 つの追加文字は、その音に近い音の文字の後に任意に配置されます。したがって、q は k の直後に、x (ドイツ語のchのように発音) は h の直後に、ə (英語の短い a のように発音) は e の直後に配置されます。ブルトン語 には「c」、「q」、「x」はありませんが、「b」と「d」の中間の二重音字「ch」と「c'h」があります。例えば、「 buzhugenn, chug, c'hoar, daeraouenn 」(ミミズ、ジュース、姉妹、涙)などです。チェコ語 とスロバキア語 では、アクセント付き母音は二次的な照合重みを持ちます。他の文字と比較すると、アクセントなしの形として扱われます (チェコ語では A-Á、E-É-Ě、I-Í、O-Ó、U-Ú-Ů、Y-Ý、スロバキア語では A-Á-Ä、E-É、I-Í、O-Ó-Ô、U-Ú、Y-Ý)。しかし、アクセントなしの文字の後にソートされます (たとえば、正しい辞書順は baa、baá、báa、báá、bab、báb、bac、bác、bač、báč [チェコ語] および baa、baá、baä、báa、báá、báä、bäa、bäá、bää、bab、báb、bäb、bac、bác、bäc、bač です)。 báč、bäč [スロバキア語])。アクセント付き子音は主要な照合重みを持ち、アクセントなし子音の直後に照合されます。ただし、Ď、Ň、Ť (チェコ語) および Ď、Ĺ、Ľ、Ň、Ŕ、Ť (スロバキア語) は例外で、二次重みを持ちます。CHは 独立した文字とみなされ、H とI の間に入ります。スロバキア語では、DZ とDŽ も独立した文字とみなされ、Ď とE の間に配置されます。デンマーク語とノルウェー語のアルファベット には、スウェーデン語と同じ余分な母音(下記参照)が存在しますが、順序とグリフ が異なります(…、X、Y、Z、Æ 、Ø 、Å )。また、「Aa」は「Å」と同等とみなされます。デンマーク語のアルファベットでは、従来「W」は「V」の異形とされていましたが、現在では「W」は独立した文字とみなされています。オランダ語 では、 IJ ( IJ を表す) の組み合わせは、以前は Y (または、場合によっては別の文字として: Y < IJ < Z) と照合されていましたが、現在ではほとんどの場合 2 文字 (II < IJ < IK) と照合されています。例外は電話帳です。多くのオランダ語の姓では、現代の綴りでは IJ が必要となる箇所で Y が使用されているため、ここでは IJ は常に Y と照合されます。ij で始まる単語で、大文字の I で書かれているものは、大文字の J で書かれていることに注意してください。たとえば、町のIJmuiden 、川のIJssel 、国の IJsland (アイスランド ) などです。エスペラント語 では、曲折 アクセント記号が付いた子音(ĉ 、ĝ 、ĥ 、ĵ 、ŝ )とŭ (breve 付きのu )は、それぞれ別の文字として数えられ、別々にまとめられます(c、ĉ、d、e、f、g、ĝ、h、ĥ、i、j、ĵ...s、ŝ、t、u、ŭ、v、z)。エストニア語 では、õ 、ä 、ö 、ü は独立した文字とみなされ、w の 後に並びます。š 、 z 、ž は 外来語や外国語の固有名詞にのみ現れ、エストニア語のアルファベット ではs の後に続きます。それ以外は、基本的なラテン文字と変わりません。フェロー語のアルファベットに は、デンマーク語、ノルウェー語、スウェーデン語の特殊文字であるÆ とØ も含まれています。さらに、フェロー語のアルファベットでは、 D の後に続くアイスランド語のethが使われています。6つの母音のうち、 A 、I 、O 、U 、Y の5つはアクセント記号が付くことがあり、その後は独立した文字として扱われます。子音のC 、Q 、X 、W 、Z は存在しません。したがって、最初の5文字はA 、Á 、B 、D 、Ð であり、最後の5文字はV 、Y 、Ý 、Æ 、Øです。 フィリピン語 (タガログ語)やその他のフィリピン諸語では、文字 Ng は独立した文字として扱われます。発音はsing 、ping-pong などと同じです。単独ではnang と発音されますが、一般的なフィリピン語の正書法では、2 つの独立した文字 (n と g) として綴られます。また、派生文字 ( Ñ など) は、基本文字の直後に続きます。フィリピン語は発音記号も使用しますが、チルダを 除いて使用頻度は非常に低いです。フィンランド語のアルファベット と照合規則は、スウェーデン語のものと同じである。 フランス語 では、単語の最後のアクセントによって語順が決まります。 [ 16 ] 例えば、フランス語では、次の4つの単語は、cote < côte < coté < côté の順に並びます。文字 e は e é è ê ë (œ は oe とみなされる) の順に並び、o は ô ö と並びます。ドイツ 語では、ウムラウト 付きの文字( Ä 、Ö 、Ü ) は、一般的にウムラウトなしの文字と同じように扱われます。ßは 常に ss としてソートされます。これにより、アルファベット順は Arbeit、Arg、Ärgerlich、Argument、Arm、Assistent、Aßlar、Assoziation となります。電話帳や同様の名前リストでは、ウムラウトは文字の組み合わせ「ae」、「oe」、「ue」のように照合されます。これは、多くのドイツ語の姓がウムラウト付きとウムラウトなしの「e」付きの両方で出現するためです (Müller/Mueller)。これにより、アルファベット順は Udet、Übelacker、Uell、Ülle、Ueve、Üxküll、Uffenbach となります。ハンガリー語の 母音にはアクセント、ウムラウト、二重アクセントがあり、子音は単文字、二重文字(二重音字)、三重文字(三重音字)で表記されます。照合においては、アクセント付き母音はアクセントなし母音と同等であり、二重文字と三重文字は元の単文字に続きます。ハンガリー語のアルファベット順は次のとおりです。A=Á、B、C、Cs、D、Dz、Dzs、E=É、F、G、Gy、H、I=Í、J、K、L、Ly、M、N、Ny、O=Ó、Ö=Ő、P、Q、R、S、Sz、T、Ty、U=Ú、Ü=Ű、V、W、X、Y、Z、Zs。 (1984 年以前は、dz とdzs は 照合において単一の文字とはみなされず、それぞれ d+z と d+zs の 2 文字として扱われていました。)これは、照合においてc が cs の 前に来るため、例えばnádcukor は nádcsomó の 前に来る必要があることを意味します(通常s は u の前に来ますが)。母音の長さの違いは、2 つの単語がそれ以外は同一である場合にのみ考慮する必要があります(例: egér、éger )。句内のスペースとハイフンは照合において無視されます。Chも 特定の単語で二重音字として出現しますが、照合においてはそれ自体が独立した文字とはみなされません。 ハンガリー語の照合の特別な特徴は、二重二文字または三文字の短縮形(gy + gy からggy やdzs + dzs からddzs など)は、短縮という事実や二文字または三文字の要素に関係なく、完全な形で書かれているかのように照合する必要があることです。たとえば、kaszinó は kassza の前に来るべきです(通常、アルファベットではs の後に4 番目の文字z が来ますが)。これは、 kassza という単語の4 番目の「文字」(文字素)が 2 番目の sz (ssz を sz + sz に分解)とみなされ、 i の後に来る(kaszinó の場合)ためです。 アイスランド語 では、Þ が追加され、D の後にはÐ が続きます。各母音 (A、E、I、O、U、Y) の後には、対応する母音と鋭音記号が続きます。Á、É、Í、Ó、Ú、Ý。Z はないので、アルファベットは X、Y、Ý、 Þ 、Æ 、Ö で終わります。これらの文字はどちらもアングロサクソン人の 書記官によっても使用されており、彼らはルーン文字のウィンを /w/を表すために使用していた。 Þ (ソーンとも呼ばれる。小文字のþ)もルーン文字である。Ð (エスとも呼ばれる。小文字はð)は、文字D にストロークを追加したものです。キオワ語は、歴史的なラテン語の順序ではなく、 ブラーフミー文字 のような音声学的原則に基づいて配列されています。母音が最初に来て、次に破裂子音が口の前から後ろへ、そして声帯開始時間 が否定から肯定へと順に並び、最後に破擦音、摩擦音、流音、鼻音が続きます。A、AU、E、I、O、U、B、F、P、V、D、J、T、TH、G、C、K、Q、CH、X、S、Z、L、Y、W、H、M、N リトアニア語 では、特にリトアニア語の文字はラテン文字の後に続きます。もう一つの変更点は、Yが Jの 直前に来ることです。: ... G、H、I、Į、Y、J、K...マルタ語のアルファベット では、二重音字 GĦ と IE はそれぞれ一文字として扱われ、ペアの最初の文字の後に並びます。点付きの文字 (Ċ Ġ Ż) は元の文字の前に並び、Ħ は H の後に置かれます。アクセント記号、アポストロフィ、ハイフンは無視されます。ただし、2 つの単語が同じ順序で並ぶ場合は、これらの発音記号が考慮され、アクセント付きの文字がアクセントなしの文字の後に続きます。ポーランド語 では、特にラテン文字から派生したポーランド文字は、元の文字に従って以下のように分類されます。A、Ą、B、C、Ć、D、E、Ę、...、L、Ł、M、N、Ń、O、Ó、P、...、S、Ś、T、...、Z、Ź、Ż。分類の目的では、二重音字は2つの別々の文字として扱われます。ピンインのアルファベット順 では、単語の基本文字が同じで、修飾子のみが異なる場合、修飾されていない文字が修飾された文字の前に来ます。たとえば、⟨ e ⟩は ⟨ ê ⟩ の前に来ます(額 ( è ) は欸 ( ê̄ ) の前に)、⟨ u ⟩は ⟨ ü ⟩ の前に来ます(路 ( lù ) は驢 ( lǘ ) の前に、努 ( nǔ ) は女 ( nǚ ) の前に)。同じピンイン文字(変化文字⟨ê⟩と⟨ü⟩を含む)を持つ文字は、 「第一声 ( 平声 ) 、 第二声(上昇声)、第三声(下降上昇声)、第四声(下降声)、第五声(中性声)」の順に声調に従って並べられます。例えば、「媽(mā )、麻(má )、馬(mǎ )、汚(mà )、嗎(ma )」などです。[ d ] ポルトガル語 では、アルファベットの並び順は英語と同じで、A、B、C、D、E、F、G、H、I、J、K、L、M、N、O、P、Q、R、S、T、U、V、W、X、Y、Z の順です。二重音字や発音記号付きの文字はアルファベットに含まれません。ルーマニア語 では、ラテン文字から派生した特殊文字は、元の文字の順に並べられます: A、Ă、Â、...、I、Î、...、S、Ș、T、Ț、...、Z。セルビア・クロアチア語 やその他の関連する南スラブ語では、5 つのアクセント付き文字と 3 つの結合文字は、元の文字の順に並べられています: ...、C、Č、Ć、D、DŽ、Đ、E、...、L、LJ、M、N、NJ、O、...、S、Š、T、...、Z、Ž。スペイン語では (1994 年まで) 「CH」と「LL」を単一の文字として扱い、 cinco 、credo 、chispa とlomo 、luz 、llama の順序を与えていました。1994年に RAE が より一般的な用法を採用したため、これはもはや当てはまらず、現在では LL は LK と LM の間に、CH は CG と CI の間に照合されます。発音記号 Á、É、Í、Ó、Ú、Ü の 6 つの文字は、元の文字 A、E、I、O、U として扱われます。例: radio 、ráfaga 、rana 、rápido 、rastrillo 。 スペイン語固有の照合に関する唯一の問題は、Ñ ( eñe ) が N の後に照合される別の文字であることです。スウェーデン語のアルファベット には、デンマーク語やノルウェー語のアルファベットと同様に、末尾に3つの母音(…、X、Y、Z、 Å 、Ä 、Ö )が追加されていますが、グリフと照合順序が異なります。「W」は「V」の異体字として扱われてきましたが、 スウェーデン語アカデミーのアルファベット 第13版(2006年)では「W」は独立した文字とみなされました。トルコ語のアルファベット には、ç、ğ、ı、ö、ş、ü の 6 つの追加文字があります (ただし、q、w、x はありません)。これらの文字は、ç が c の後、ğ が g の後、ı がi の前 、ö が o の後、ş が s の後、ü が u の後に配置されます。元々、1928 年にアルファベットが導入された当初は、ı は i の後に配置されていましたが、後に順序が変更され、点、セディーユ、その他の装飾記号を含む形状の文字は、対応する無装飾の文字の後に必ず配置されるようになりました。トルコ語の正書法では、文字 I は点のない ı の大文字であり、İ は点のある i の大文字であることに注意してください。多くのテュルク諸語( アゼルバイジャン語 やタタール語の ジャアリフ 表記など)では、かつてG とHの間に Gha (Ƣƣ)という文字が存在したが、現在は使われていない。ベトナム語 には、 ă 、â 、đ 、ê 、ô 、ơ 、ư の 7 つの追加文字がありますが、 f 、j 、w 、z は存在しません。ただし、インターネット アドレスや外来語など、一部では依然として使用されています。「f」は「ph」という組み合わせに置き換えられます。「w」も同様に「qu」です。Volapük ä では、ö とü は 別々の文字として数えられ、別々にまとめられます (a、ä、b ... o、ö、p ... u、ü、v) が、q とw は存在しません。[ 17 ] ウェールズ 語では、二重音字 CH、DD、FF、NG、LL、PH、RH、TH は単一の文字として扱われ、それぞれペアの最初の文字の後にリストされます (NG は G の後にリストされます)。これにより、A、B、C、CH、D、DD、E、F、FF、G、NG、H などの順序になります。ただし、単語の合成によって、二重音字を形成しない 2 つの文字が並置されることがあります。例として、LLONGYFARCH (LLON + GYFARCH から構成) という単語があります。これにより、例えば LAWR、LWCUS、LLONG、LLOM、LLONGYFARCH のような順序になります (NG は LLONG では二重音字ですが、LLONGYFARCH では二重音字ではありません)。文字の組み合わせ R+H (二重音字 RH とは異なる) も同様に複合語で並置されることで生じる可能性がありますが、この場合、誤認によって順序が変わるような組み合わせは生じません。その他、紛らわしい可能性のある文字の組み合わせ、すなわち D+D と L+L については、綴りにハイフンが使用されます (例: AD-DAL、CHWIL-LYS)。
注記 ↑ ナタンの『アルーフ』は 最初のアルファベット順のタルムード辞典ではなかったかもしれないが、非常に人気を博し、今日でも使用されている。その前身として考えられるのは、マキル・ベン・イェフダ の失われた『アルファ・ベータ』 である。 ↑ MS Explorer の場合、スペース、アポストロフィ (U+0027)、およびすべてのハイフンのような文字 (U+002D および U+2010 から U+2014 まで) は、プライマリソートキーから除外されます。 ↑ 例えば、 Harrap's Shorter Dictionnaire Anglais-Français/ Français-Anglais 、ISBN 0-245-60660-2、640 ページには、 oil、oil-bearing、oilcan、oilcloth、oil-cooled、oiled […] oiliness、oil lamp、oil paint、oil painting、oilpaper の 順序が記載されています。 ↑ 例外があります。ABC中国語-英語辞典 では、声調の順序は「ゼロ声調(中性声調)、第一声調(平坦声調)、第二声調(上昇声調)、第三声調(下降上昇声調)、第四声調(下降声調)」となっています。
参考文献 ↑ロビンソン、アンドリュー ( 2007) [1995]。『書くことの物語』 (第2 版)。ロンドン:テムズ&ハドソン。p. 162。ISBN 978-0-500-28660-9 。 ↑ Millard, AR (1986). "アルファベットの黎明期". World Archaeology . 17 (3): 390–398 . doi : 10.1080/00438243.1986.9979978 . JSTOR 124703 . ↑ ラインハルト・G・レーマン:「27-30-22-26。アルファベットには何文字必要か?セム語の場合」、『書くことの概念:国境を越える書くこと』 、アレックス・デ・ヴォートとヨアヒム・フリードリヒ・クアック編、ライデン:ブリル、2012年、11-52頁。 1 2 3 Street, Julie (2020年6月10日)。 「AからZまで - アルファベット順の驚くべき歴史」 (テキストと音声) 。ABC ニュース(ABCラジオ・ナショナル) 。オーストラリア放送協会。 2020年7月2日のオリジナルから アーカイブ。 2020年 7月6日 取得 。 ↑ 例:ヘブライ語聖書の詩篇25、34、37、111、112、119、145 ↑ デイリー、ロイド。『古代および中世におけるアルファベット化の歴史への貢献』 ブリュッセル、1967年、25ページ。 ↑ オハラ、ジェームズ (1989)。 「メッサプス、キクナス、そしてバージルのイタリア英雄カタログのアルファベット順」。 フェニックス 。 43 (1): 35–38 . 土井 : 10.2307/1088539 。 JSTOR 1088539 。 ↑ LIVRE XI – texte latin – traduction + commentaires . 2012年6月9日にオリジナルから アーカイブ済み 。 2012年 5月8日 に取得。 ↑ ギブソン、クレイグ (2002)。 古典の解釈:デモステネスと古代の注釈者たち 。 ↑ ラウズ、メアリー A.、ラウズ、リチャード M. (1991)、「 Statim invenire : Schools, Preachers and New Attitudes to the Page」、 Authentic Witnesses: Approaches to Medieval Texts and Manuscripts 、ノートルダム大学出版局、pp. 201–219 、 ISBN 0-268-00622-9 ↑ コーディリー、ロバート (1604)。 アルファベット順表 。ロンドン。p. [A4]v。 ↑ コールリッジの手紙、第507号 。 2011年7月13日に オリジナルからアーカイブされました。 ↑ Tscharntke, Teja; Hochberg, Michael E; Rand, Tatyana A; Resh, Vincent H; Krauss, Jochen (2007 年 1 月). "共著論文における著者順序と貢献に対するクレジット" . PLOS Biol . 5 (1): e18. doi : 10.1371/journal.pbio.0050018 . PMC 1769438 . PMID 17227141 . ↑ Stevens, Jeffrey R.; Duque, Juan F. (2018). "順序は重要:本文中の引用をアルファベット順に並べると引用率に偏りが生じる" (PDF) . Psychonomic Bulletin & Review . 26 (3): 1020– 1026. doi : 10.3758/s13423-018-1532-8 . PMID 30288671 . S2CID 52922399 . 2018年11月10日のオリジナルから アーカイブ (PDF) . 2018年 11月10日 に取得 . 要約: Colleen Flaherty (2018年10月22日) 「著者名のアルファベット順命名に反対する論拠」 Inside Higher Ed 。 ↑ 「アラビア語の数学的アルファベット記号」 (PDF) 。Unicode 標準。2022 年 10 月 30 日にオリジナルから アーカイブ (PDF) 。2022 年 11 月 26 日 に取得 。 1 2 「Unicode技術標準第10号:Unicode照合アルゴリズム」 。Unicode, Inc. (unicode.org)。2008年3月20日。 2008年8月27日のオリジナルから アーカイブ 。 2008年 8月27日 に取得。 ↑ ミッジリー、ラルフ。 「Volapük語から英語への辞書」 (PDF) 。 2012年9月1日に オリジナル (PDF)からアーカイブ済み。 2019年 9月24日 に取得 。 ↑ Franz Baader; Tobias Nipkow (1999). Term Rewriting and All That . Cambridge University Press. pp. 18–19 . ISBN 978-0-521-77920-3 。
さらに読む ショーヴァン、イヴォンヌ。アルファベットのクラス分けの練習 。第4版パリ: ボルダス、1977。ISBN 2-04-010155-1 フランダース、ジュディス 。『万物の定位置:アルファベット順の奇妙な歴史 』ニューヨーク:ベーシックブックス/ハチェットブックス、2020年。ISBN 978-1-5416-7507-0