DIN規格DIN 91379「CD-ROM付き、ヨーロッパにおける名前の電子処理およびデータ交換のためのUnicodeの文字および定義済み文字シーケンス」[ 1 ]は、人名、法人名、製品名、住所などに使用するUnicodeラテン文字、基本文字および発音記号のシーケンス、特殊文字の規範的サブセットを定義しています。この規格は、 ICAOの勧告の拡張として、ラテン文字から基本文字AZへの規範的マッピングを定義しています。[ 2 ]
規格の情報部分では、拡張文字セットが定義されており、これにはギリシャ文字やキリル文字のほか、法人名や製品名に使用されるその他の特殊文字が含まれる。
このサブセットは、欧州連合加盟国のすべての公用語に加え、アイスランド、リヒテンシュタイン、ノルウェー、スイスの公用語、およびドイツ語の少数言語をサポートしています。
ラテン文字を使用しない他の言語をサポートするために、規範文字セットには、発行時に関連するISO規格に従って名前をラテン文字に翻字するために必要なラテン文字と発音記号のすべての組み合わせが含まれています。 [ a ]
この規格は、戸籍登録簿への記入に必要な文字をサポートしています。戸籍登録簿への姓と名の記録に関する1973年9月13日の条約に関する法律[ 3 ] [ 4 ]によれば、ラテン文字の情報はすべての発音記号を含めてそのまま引き継がれ、その他の文字の情報は、可能であればISO規格に従って音訳によって再現されます。
このサポートは完全ではありません。ラテン文字を使用する非ヨーロッパ言語については、例えばベトナム語はサポートされていますが、例えばトーゴの公用語であるエウェ語(ɖ、ɛ、ƒ、ɣ、ɔ、ʋが欠落)とカビエ語(ɖ、ɛ、ɣ 、ɩ 、 ɔ、ʊが欠落)、南アフリカの公用語であるツシヴェンダ語(ḓ、ḽ、ṋ、ṱ が欠落)、ナミビアの公用語であるコイコイゴワブ語(クリック音の文字 ǀ、ǁ、ǃ、ǂ が欠落)、トンガ語(fakauʻaが欠落)などはサポートされていません。括弧内に記載されている文字はそれぞれの国の人名に登場しますが、この規格では、名前を基本的なラテン文字で表記するための音訳規則やマッピング規則は規定されていません。
この規格では、標準文字に加えて、ギリシャとキプロス用の現代ギリシャ文字、ブルガリア用のキリル文字、および製品名や法人名用の特殊文字を含む拡張文字のサブセットを定義しています。
準拠するアプリケーションは追加の文字をサポートする可能性がありますが、インターフェースの合意やレジスタに関しては、この標準に基づいて最終的な文字とシーケンスのサブセットのみをサポートすることが適切である場合があります。[ 5 ]
前身である DIN SPEC 91379 のテキスト[ 6 ] 、説明、およびExcelファイルとXMLファイルとしての文字とシーケンスのリストは、Koordinierungsstelle für IT-Standards (KoSIT)にあります。[ 5 ]この参照には、この規格で定義されているサブセットへのテキストの適合性をチェックするためのパターンを含むXML スキーマファイルも含まれています。 DIN SPEC 91379 および DIN 91379 の文字とシーケンスのリストは、プレーン テキストファイルとして GitHub のDIN 91379 Characters and Sequencesから入手できます。[ 7 ] DIN には、いくつかの追加の文字とシーケンスが含まれています。[ 7 ] [ 1 ]
連邦政府と州政府内および州政府間のデータ交換、または市民や企業とのデータ交換に使用されるすべてのIT手順は、2024年11月1日からDIN 91379に準拠しなければならない。[ 8 ]
ドイツ連邦ITのアーキテクチャガイドラインでは、2022年7月版の旧規格DIN SPEC 91379の使用が義務付けられています。[ 9 ]
連続したテキストや歴史的な手紙は、この規範の範囲外です。[ 1 ]
DIN規格は規範的[ 10 ]と情報的[ 10 ]の部分から構成されています。
規範部分の要件は、すべての準拠システムに対して拘束力を持つ。規範部分では、基本ラテン文字と発音記号を含む名前を処理するための文字が指定されている。すべての準拠システムはこれらの文字をサポートしなければならない。さらに、規範文字と基本ラテン文字AZとのマッピングが定義されている。
準拠システムは、規範的な文字に加えて、追加の文字をサポートする場合があります。
参考情報に記載されている推奨事項は、準拠システムに対して拘束力を持つものではありません。参考情報では、例えば法人名、製品名、EU域内でのデータ交換などに使用される拡張文字のUNICODEサブセットを規定しています。さらに、参考情報では、データフィールドのチェックに使用できるデータ型も定義しています。
この基準に準拠するためには、
準拠するITシステムは、すべての氏名欄に規定の文字を処理できなければなりません。これには、収集、保存、送信、表示、および印刷が含まれます。
規範的な文字グループを以下に示します。関連する文字は、DIN 91379「機械処理用の文字とシーケンス」にも記載されています。[ 7 ]以下の文字テーブルは、DIN付録のXMLファイルchars.xml から生成されました。
これらの文字は、特に個人名を表すために、支えとなるものでなければならない。
これらの文字は、名前、特に個人名を表すためにサポートされている必要があります。
これらの文字は、地名、通り名、番地、法人名、商品名など、より広い意味での名前を表すためにサポートされる必要があります。個人名には適していません。
これらの文字は、 Unicode の標準ラテン文字との下位互換性のために含まれています。バージョン 1.1.1 。[ 11 ]
これらは個人名やその他の名称には関係なく、法人名と製品名にのみ適用されます。
これらの空白文字は名前を表すには不向きだが、処理する必要がある。
NO-BREAK SPACEという文字は、意味が変わってしまう可能性のある特殊な名前での改行を防ぐために必要です。その他の文字は、Unicode の標準ラテン文字との下位互換性のために含まれています。バージョン 1.1.1。[ 11 ]
既存の文書や登録簿には、現在では使用されていない旧式の文字が含まれています。これらの文字は、準拠したITシステムでサポートされる必要があります。新規登録を作成する際には、旧式の文字を使用しないでください。
以下に、すべての標準文字を基本ラテン文字A~Zにマッピングした標準図を示します。このマッピングは、例えばパスポートの機械読み取り領域などで必要となります。また、検索フォームの作成にも利用でき、名前の綴りが異なっていても、あるいは発音記号を指定しなくても、名前を検索できるようになります。
以下の表は、DIN 91379 の表 9 と、ICAO の機械可読旅行文書仕様書の第 6 章、表 A に基づいています。[ 2 ]この表は、DIN 91379 付録のXML ファイルchars.xmlの情報を使用して作成されました。
ICAO仕様書およびDIN表9に記載されている項目は、 「マッピング」列に「ICAO」とマークされ、DIN表9の追加項目は「EXT」とマークされます。「タイプ」列では、 IDマッピングを記述する項目には「ID」が、その他のマッピングには「MAP」が指定されます。
Each conforming IT system should be able to handle the extended letters for all name fields. This includes the collection, storage, transmission, display, and printout.
For cross-border data exchange, every IT system should support Greek letters in name fields.
For cross-border data exchange, every IT system should support Cyrillic letters in name fields for Bulgarian names.
These letters should be supported for legal entity names and product names.
For information, technical data types are defined as subsets of the letters defined in the standard. These can be used for interface agreements, for technical checks or as a basis for creating your own data types. An implementation as an XML schema type is included in the din-91379-datatypes.xsd file attached to the standard. This implementation is also freely available under the CC BY-ND license as part of the XOEV library.[12]
Compared to DIN SPEC 91379, some additional letters have been included, only two of these letters are not deprecated.
Current results of the standardization process include the specification DIN SPEC 91379 in March 2019 and final DIN standard in August 2022. The CEN/TC 224/WG 19 working group is working on the further development of this standard into the European standard EN 00224284 in the 04301181 project.[5][13] According to AFNOR norminfo the project started in Dec. 2024 with a design phase, in April 2026 a public inquiry should start and the publication of the standard is planned for Nov. 2027. [14]
The German keyboard layoutsE1 and E2 standardized in the DIN 2137-1 standard enable the entry of all characters listed in DIN 91379 except Cyrillic letters without recourse to their Unicode value or their decimal code. Achieving this was one of the main reasons for revising these keyboard layouts compared to the previous version DIN 2137-1:2018-12.[25][26]
The version of DIN 5009:2022-06 “Word and information processing for office applications — Announcing and dictating of text and characters” published in May 2022 together with its supplement "Announcing, naming and keyboard input of special letters and characters" contains German-language names, spelling rules and spelling announcement words for all characters listed in DIN 91379 (except some outdated characters and the Greek and Cyrillic letters). This ensures that the characters can be reproduced correctly in oral communication (e.g. on the telephone).