Loading article…
Unicode照合アルゴリズム(UCA)は、Unicodeテクニカルレポート#10で定義されているアルゴリズムで、Unicodeで表現できるあらゆる表記体系と言語のテキストを表す文字列からバイナリキーを生成するカスタマイズ可能な方法です。これらのキーは、言語の規則に従って照合またはソートするために、バイトごとに効率的に比較され、大文字小文字、アクセント記号などを無視するオプションがあります。[ 1 ]
Unicodeテクニカルレポート#10では、デフォルトのUnicode照合要素テーブル(DUCET)も規定されています。このデータファイルは、デフォルトの照合順序を規定しています。DUCETはさまざまな言語に合わせてカスタマイズ可能で、[ 1 ] [ 2 ] 、そのようなカスタマイズの一部はUnicode共通ロケールデータリポジトリ(CLDR)で見つけることができます。[ 3 ]
UCA のオープンソース実装は、Unicode の国際コンポーネントICU に含まれています。[ 4 ] [ 5 ] ICU はカスタマイズをサポートしており、CLDR の照合カスタマイズが ICU に含まれています。[ 6 ] [ 2 ]