
国際化ドメイン名( IDN ) は、ソフトウェア アプリケーションで表示されるラベルが少なくとも 1 つ含まれているインターネットドメイン名です。ラベルは、全体または一部が非ラテン文字またはアルファベット[ a ]または発音記号や合字付きのラテン文字ベースの文字[ b ]で表示されます。これらの表記体系は、コンピュータによってマルチバイトUnicodeでエンコードされます。国際化ドメイン名は、ドメイン ネーム システム(DNS) にPunycode転写を使用したASCII文字列として保存されます。
DNSは、主にユーザーにとって分かりやすい名前をネットワークアドレスに変換してインターネットリソースを検索するルックアップサービスを実行しますが、実際にはASCII文字の使用に制限されています[ c ]。この実用的な制限が、当初は許容されるドメイン名の標準を定めました。ドメイン名の国際化は、言語固有のスクリプトで書かれた名前をDNSと互換性のあるASCIIテキスト表現に変換する技術的な解決策です。国際化されたドメイン名は、そのような用途のために特別に設計されたアプリケーションでのみ使用できます。インターネットのインフラストラクチャに変更を加える必要はありません。
IDNはもともと1987年12月にMartin Dürst [ 1 ] [ 2 ]によって提案され、1990年にTan Tin Weeの指導の下、Tan Juay KwangとLeong Kok Yongによって実装されました。多くの議論と競合する提案を経て、 Internationalizing Domain Names in Applications (IDNA) [ 3 ]と呼ばれるシステムが標準として採用され、いくつかのトップレベルドメインで実装されています。
IDNA では、国際化ドメイン名という用語は、ラベルのみで構成されるドメイン名で、IDNA ToASCIIアルゴリズム(下記参照) を正常に適用できるものを具体的に意味します。2008 年 3 月、IETF は、現在の IDNA プロトコルを更新するための新しい IDN ワーキング グループを設立しました[ 4 ]。2008 年 4 月、Afilias はUN-ESCWAおよびPublic Interest Registry (PIR)とともに、アラビア語スクリプト IDN ワーキング グループ (ASIWG) を立ち上げました。このワーキング グループには、DNS、ccTLDオペレーター、企業、学術界の専門家、およびエジプト、ガンビア、イラン、ヨルダン、チュニジア、アルジェリア、スーダン、ソマリア、ジブチ、クウェート、パキスタン、サウジアラビア、シリア、UAE、マレーシアから集まった地域および国際機関のメンバーが参加しました。Afilias の Ram Mohan が議長を務める ASIWG は、アラビア語スクリプト用の統一 IDN テーブルの開発を目指しました。[ 5 ]
2009 年 10 月、インターネット割り当て番号公社(ICANN) は、ネイティブ言語のスクリプトに IDNA 標準を使用する国際化国別コードトップレベルドメイン(IDN ccTLD)をインターネット上に作成することを承認しました。 [ 6 ] [ 7 ] 2010 年 5 月、最初の IDN ccTLD がDNS ルートゾーンに設置されました。[ 8 ]
アプリケーションにおけるドメイン名の国際化(IDNA)は、非ASCII文字を含む国際化ドメイン名を処理するために2003年に定義されたメカニズムです。
ドメインネームシステム(DNS)は非ASCII文字をサポートしていますが、電子メールやWebブラウザなどのアプリケーションは、ホスト名などの目的でドメイン名に使用できる文字を制限しています。厳密に言えば、ドメイン名に使用できる文字に制限を設けているのは、これらのアプリケーションが使用するネットワークプロトコルであり、制限を設けているアプリケーションやDNS自体ではありません。既存のシステムとの後方互換性を維持するため、IETF IDNAワーキンググループは、国際化ドメイン名をWebブラウザやその他のユーザーアプリケーションで処理できる適切なASCIIベースの形式に変換することを決定しました。IDNAは、非ASCII文字で記述された名前とASCIIベースの表現との間の変換方法を規定しています。
IDNA対応アプリケーションは、ドメイン名の国際化表現とASCII表現の間で変換を行うことができます。DNSルックアップにはASCII形式を使用しますが、アラビア語やひらがななどの非ASCII文字でドメイン名を読み書きすることを好むユーザーには、国際化形式を表示できます。IDNAをサポートしていないアプリケーションは、非ASCII文字を含むドメイン名を処理できませんが、(通常はかなり難解な)ASCII相当のドメイン名が提供されれば、そのようなドメインにアクセスできます。
最初のIDNガイドラインを作成するための技術コミュニティワーキンググループが2002年8月に設立されました[ 9 ]。メンバーはラム・モハン(アフィリアス)、堀田浩(JPRS)、パット・ケイン(ベリサイン)、キャリー・カープ(.museum)、ティナ・ダム(ICANN)です。これらのガイドラインのバージョン 1.0 は、RFC 3490、3491、および 3492 に反映されている IETF の提案標準に基づく IDN の展開の開始と同時に、2003 年 6 月 20 日に公開されました [ 10 ]。ガイドラインの公開後、2003 年 7 月にこのシステムを使用して .jp ドメインを登録できるようになり、2004年3月に.info [ 11 ]ドメインを登録できるようになりました。他のいくつかのトップレベルドメインレジストリは、2004 年と 2005 年に登録の受付を開始しました。これらのガイドラインは、フィッシングの懸念に対応するとともに[ 13 ] IDN のバリアントに対応するために更新されました[ 12 ]。トップレベルの国別コードドメイン名に焦点を当てた ICANN ワーキンググループは、2007 年 11 月に結成され[ 14 ]、国別コードサポート組織と政府諮問委員会によって共同で推進されました。
さらに、ICANNは、2015年にラム・モハンによって設立されたコミュニティ主導のユニバーサル・アクセプタンス・ステアリング・グループを支援しており、このグループは、すべてのアプリケーション、デバイス、システムにおけるIDNやその他の新しいgTLDの使いやすさを促進することを目指している。[ 15 ]
Mozilla 1.4、Netscape 7.1、Opera 7.11 は、IDNA をサポートする最初のアプリケーションでした。Internet Explorer 6 には、IDN をサポートするブラウザ プラグインが用意されています。Internet Explorer 7.0 [ 16 ]とWindows Vistaの URL API は、IDN をネイティブにサポートしています。[ 17 ]
ドメイン名のASCII形式と非ASCII形式間の変換は、ToASCIIとToUnicodeと呼ばれる2つのアルゴリズムによって行われます。これらのアルゴリズムはドメイン名全体ではなく、個々のラベルに適用されます。たとえば、ドメイン名がwww.example.comの場合、ラベルはwww、example、comです。ToASCIIまたはToUnicodeは、これら3つのラベルそれぞれに個別に適用されます。
ToASCII は ASCII ラベルをそのままにします。ラベルがドメイン ネーム システム (DNS) に適さない場合は失敗します。少なくとも 1 つの非 ASCII 文字を含むラベルの場合、ToASCII はNameprepアルゴリズムを適用します。これにより、ラベルが小文字に変換され、その他の正規化が実行されます。次に、ToASCII はPunycodeを使用して結果を ASCII に変換します。[ 18 ]最後に、4 文字の文字列 " xn--" を先頭に追加します。[ 19 ]この 4 文字の文字列は、ASCII 互換エンコーディング ( ACE ) プレフィックスと呼ばれます。これは、Punycode でエンコードされたラベルと通常の ASCII ラベルを区別するために使用されます。ToASCII アルゴリズムは、いくつかの方法で失敗する可能性があります。たとえば、最終的な文字列が DNS ラベルの 63 文字の制限を超える可能性があります。ToASCII が失敗するラベルは、国際化ドメイン名で使用できません。
ToUnicode関数はToASCII関数の動作を逆に行い、ACE接頭辞を削除してPunycodeデコードアルゴリズムを適用します。Nameprep処理は単なる正規化であり、本質的に不可逆であるため、ToUnicode関数はNameprep処理を逆にはしません。ToASCIIとは異なり、ToUnicodeはデコードが失敗した場合に元の文字列を返すため、常に成功します。特に、これはToUnicodeがACE接頭辞で始まらない文字列には影響を与えないことを意味します。
IDNA エンコーディングは、例のドメインを使用して説明できますBücher.example。(ドイツ語: Bücher 、文字通り「本」)。このドメイン名には、Bücherとexample という2 つのラベルがあります。2 番目のラベルは純粋な ASCII であり、変更されません。最初のラベルは Nameprep によって処理されbücher、となり、次にPunycodeに変換されてとなりますbcher-kva。次に、がプレフィックスとして付加され、xn--が生成されますxn--bcher-kva。したがって、DNS レコードやクエリで使用するのに適した結果の名前はとなりますxn--bcher-kva.example。
世界人口の約5%を占めるアラブ地域は、インターネット利用率が著しく低い。2000年代後半時点で、アラブ世界のインターネット普及率は人口の約11%にとどまり、世界平均の21.9%を大きく下回っていた。しかしながら、同地域では2000年から2008年にかけてインターネット利用が大幅に増加し、1,426%もの増加率を記録した。これは、同時期の世界平均である305.5%をはるかに上回る数字である。
アラブ地域におけるインターネット普及に影響を与える要因には、言語的なアクセス可能性などが含まれますが、これらに限定されません。アラビア語のドメインネームシステム(DNS)サービス(国際化ドメイン名、IDN)が利用可能になれば、インターネット利用がさらに促進される可能性があると考えられています。IDNの実装により、アラブのインターネットユーザーは母国語と文字でドメインを登録できるようになり、それによってローカライズされたアプリケーションやサービスの開発が促進されると期待されています。この進歩により、アラブ語圏の人々にとってインターネットリソースへのアクセスが拡大し、その関連性が高まることが期待されます。[ 20 ]
2008年4月、AfiliasはUN-ESCWAおよびPublic Interest Registry (PIR)と共同で、アラビア文字IDNワーキンググループ(ASIWG)を立ち上げました。このワーキンググループは、DNS、ccTLD運営者、企業、学術界の専門家、およびエジプト、ガンビア、イラン、ヨルダン、チュニジア、アルジェリア、スーダン、ソマリア、ジブチ、クウェート、パキスタン、サウジアラビア、シリア、UAE、マレーシアから集まった地域および国際機関のメンバーで構成されていました。Afiliasのラム・モハンが議長を務めるASIWGは、アラビア文字用の統一IDNテーブルを開発することを目的としており、これはこの種のものとしては初めてのものでした。
ASIWGの作業により、最初のルートゾーン生成ルール(RZ-LGR-1)が作成され、アラビア文字が対象となりました。これは、結合記号やコードポイントシーケンスを含まない、アラビア文字のための最初の統一されたレパートリーを表しており、簡素化され技術的に健全な結果をもたらし、アラビア文字がインターネットのルートゾーンに統合されることにつながりました。[ 21 ]
2009年、ICANNは、国コードトップレベルドメインの規則と同様に、国や独立地域に割り当て可能な新しいタイプのトップレベルドメインを導入することを決定しました。ただし、ドメイン名は、申請者の言語固有の非ラテン文字またはスクリプトで、十分な視覚的独自性を確保するための一定のガイドラインの範囲内で、任意の文字、記号、またはグリフの文字列にすることができます。
IDN国別コードドメインのインストールプロセスは、トップレベルドメイン内のサブドメイン群での長期間のテストから始まった。11のドメインでは、ギリシャ語で「テスト」を意味する「δοκιμή」 [ 22 ]testなど、言語固有のスクリプトやアルファベットが使用された。
これらの取り組みは、2010年に実運用向け初の国際化国別コードトップレベルドメイン(IDN ccTLD)の創設という形で結実した。
ドメインネームシステムでは、これらのドメインは、接頭辞「」に続いて、言語固有のアルファベットまたはスクリプトグリフのUnicode表現のPunycode変換が続くASCII表現を使用します。たとえば、ロシアのIDN ccTLDのキリル文字名は「рф」です。Punycode表現では「」となり、DNS名は「」となります。xn--p1aixn--p1ai
他のレジストリは非ASCIIドメイン名をサポートしています。タイのThaiURL.com社は、独自のIDNエンコーディングであるThaiURLを使用して「.com」ドメインの登録をサポートしています。しかし、最新のブラウザのほとんどはIDNA/Punycode IDNしか認識しないため、ThaiURLエンコードされたドメインはエンコードされた形式で入力またはリンクする必要があり、アドレスバーにもそのように表示されます。このため利便性は制限されますが、それでも有効で普遍的にアクセス可能なドメインです。
ドメイン名にUnicodeを使用すると、WebブラウザでのIDN文字列の視覚的な表示によっては、偽サイトが偽装対象の正規サイトと区別がつかなくなる可能性があるため、Webサイトのなりすましが容易になる場合があります。例えば、Unicode文字U+0430(キリル文字の小文字a)は、英語で使用されるUnicode文字U+0061(ラテン文字の小文字a)と全く同じように見えることがあります。具体的な例として、キリル文字のа、е、і、р ( a ; 次に「Ie」/「Ye」U+0435、ラテン文字のeとほぼ同じ; 次に U+0456、ラテン文字のiとほぼ同じ; そして「Er」U+0440、ラテン文字のpとほぼ同じ) を使用すると、URL wіkіреdіа.org が形成され、これは (おそらくフォントによっては) 正規の wikipedia.org の視覚的表現とほとんど区別がつきません。
多くのトップレベルドメインが、セカンドレベルまたはそれ以下のレベルでの国際化ドメイン名の登録を受け付けるようになった。Afilias (.INFO) は、2004 年にドイツ語で最初の gTLD IDN セカンドレベル登録を提供した。[ 23 ]
TLD AsiaのレジストラであるDotAsiaは、中国語、日本語、韓国語のセカンドレベルドメイン登録について、2011年5月11日から70日間のサンライズ期間を実施した。[ 24 ]
{{cite web}}: CS1 maint: 複数の名前: 著者リスト (リンク)