| 楔形文字 | |
|---|---|
| 範囲 | U+12000..U+123FF (1,024 コードポイント) |
| 飛行機 | スムム |
| スクリプト | 楔形文字 |
| 主なアルファベット | シュメール語 アッカド語 エラム語 ヒッタイト語 フルリ語 |
| 割り当て済み | 922 コードポイント |
| 未使用 | 102 予約コードポイント |
| Unicode バージョン履歴 | |
| 5.0 (2006) | 879 (+879) |
| 7.0 (2014) | 921 (+42) |
| 8.0 (2015) | 922 (+1) |
| Unicodeドキュメント | |
| コードチャート ∣ Webページ | |
| 注: [1] [2] | |
Unicodeでは、シュメール・アッカド楔形文字は、補助多言語面(SMP)の3 つのブロックでカバーされています。
- U+12000–U+123FF楔形文字
- U+12400–U+1247F楔形文字の数字と句読点
- U+12480–U+1254F初期王朝の楔形文字
ユニコードコンソーシアム[3]が公開したチャートファイル内のサンプルグリフは、古典シュメール語(初期王朝時代、紀元前3千年紀半ば)の文字を示しています。楔形文字テキストの大部分が書かれた紀元前2千年紀と1千年紀に書かれた文字は、同じ文字のフォントのバリエーションであると考えられています。
キャラクターのインベントリと順序
この文字の Unicode エンコードの最終提案は、経験豊富な Unicode 提案作成者と共同作業を行った 2 人の楔形文字学者によって 2004 年 6 月に提出されました。[4] 基本文字目録は、ミゲル・シヴィル、ライクル・ボーガー (2003 年)、ロバート・イングランドの目録に基づいてUCLAの楔形文字デジタル ライブラリ イニシアティブがまとめたウル III 文字のリストから派生したものです。既存のカタログの番号に従ってグリフの形状と複雑さで直接順序付けるのではなく、実用的な近似値として、グリフの Unicode 順序は、その「主な」シュメール語の音訳のラテン アルファベット順に基づいています。
Borger (2003) がリストした 907 の記号のうち、約 200 は単一のコード ポイントでエンコードされていません。逆に、Borger が縮約可能と考えたいくつかの組み合わせには、固有のコード ポイントが割り当てられました。これらの違いは、楔形文字で単一の文字を表すものを特定するのが難しいためであり、実際、エンコードされていない Borger の項目のほとんどは、語源的に簡単に分解できます。普遍的に認識されている記号がまだかなり多く欠落しており、エンコードは「通常のテキストで単一の記号として実際に機能するものに関する、何世代にもわたるアッシリア学者の蓄積された知識の重要な部分を無視しており、従来の記号リスト、最も最近で包括的な Borger のMesopotamische Zeichenlisteに反映されている」という批判が出ています。[5]例えば、KURUM 7(Borger 2003 no. 729)のように、初期にはIGI.NÍGと書かれていたが、後にIGI.ERIMと書かれたように、様々な構成記号の合字として書かれた記号がある。KURUM 7にはコードポイントがないので、記号はグリフの形状に応じてIGI.NÍG(U+12146 U+1243C、𒅆𒐼)またはIGI.ERIM(U+12146 U+1209F、𒅆𒂟)のいずれかで表現されなければならず、グリフではなく文字をエンコードするというUnicodeの基本原則に違反している[要出典]。これらの記号は、他の多くの文字 (「ラテン拡張」など)で行われたように、原則として将来的に「楔形文字拡張」の範囲で追加される可能性がありますが、Unicode 7.0 の時点ではこれらの記号が存在しないため、実際のテキストのエンコードに対する標準の有用性は限られています。
グリフの形状や複雑さによる順序付けを選択するのではなく、Unicode の文字の順序は、その「主な」シュメール語の音訳のラテン アルファベット順になっています (記号は SAR と SI の間に Š- (SH- と音訳) の上に配置します)。ほとんどの場合 (すべてではありませんが)、記号の最もよく知られている値が別の値であっても、元々複雑な記号 (「合字」) の「語源的」分解が選択されています。たとえば、U+12066 𒁦 CUNEIFORM SIGN DAG KISIM5 TIMES LU PLUS MASH2は AMAŠ としてよく知られており、U+12258 𒉘 CUNEIFORM SIGN NINDA2 TIMES NEは ÁG としてよく知られており、U+1212F 𒄯 CUNEIFORM SIGN HI TIMES ASH2 はḪAR または ḪUR としてよく知られています。
標識一覧
次の表は、ボーガーの 1981 年と 2003 年の番号付けを Unicode 文字と照合するものです[6] 「主要な」翻字列には、公式のグリフ名で与えられたグリフのシュメール語の値が含まれていますが、ここでは読みやすさのために「TIMES」ではなく「x」などの伝統的なアッシリア学の記号を含めることで若干変更されています。正確な Unicode 名は、「CUNEIFORM [NUMERIC] SIGN」を前に付け、「TIMES」を「x」、「PLUS」を「+」、「OVER」を「/」、「ASTERISK」を「*」、「H」を「Ḫ」、「SH」を「Š」に置き換え、大文字に切り替えることで明確に復元できます。
シュメール・アッカド楔形文字
コードチャート
シュメール・アッカド楔形文字は、2006 年 7 月にバージョン 5.0 がリリースされ、 Unicode標準に追加されました。
シュメール・アッカド楔形文字の Unicode ブロックは U+12000–U+123FF です。
歴史
次の Unicode 関連文書には、楔形文字ブロック内の特定の文字を定義する目的とプロセスが記録されています。
参照
参考文献
引用
- ^ 「Unicode 文字データベース」。Unicode標準。2023 年 7 月 26 日閲覧。
- ^ 「Unicode 標準の列挙バージョン」。Unicode標準。2023 年 7 月 26 日閲覧。
- ^ 楔形文字 Unicode.org チャート (PDF)
- ^ ユニコード楔形文字
- ^ L. アンダーソン、2004 年 6 月[永久リンク切れ]
- ^ (アンダーソンの標識リストより 2010-04-08 に Wayback Machineでアーカイブ)
文献
- Rykle Borger、アッシリア・バビロニッシュ・ツァイヘンリスト、第 2 版、ノイキルヒェン・ヴリュイン (1981)
- Rykle Borger、Mesopotamisches Zeichenlexikon、ミュンスター (2003)。
- Michael Everson、Karljürgen Feuerherm、Steve Tinney、「UCS の SMP で楔形文字をエンコードするための最終提案」、ISO/IEC JTC1/SC2/WG2 N2786 (2004)。
外部リンク
- cuneiformsigns.org ロイド・アンダーソン
- 楔形文字 Unicode.org チャート (PDF)
- 楔形文字の数字と句読点 Unicode.org チャート (PDF)
フォントパッケージ
- アッカド語 Archived 2011-07-21 at the Wayback Machine (Unicode (参照表) に記載されているシュメール語 (紀元前 3 千年紀) のグリフを再現)、George Douros 著 Archived 2011-07-21 at the Wayback Machine。
- FreeIdgSerif ( FreeSerifから分岐) は、ヒッタイト楔形文字で使用されている約 390 の古代アッシリア語 (紀元前 2 千年紀) のグリフをエンコードします。(ドイツ語)
- Noto Sans Cuneiform (楔形文字の 3 つのブロックすべてをエンコードします。SIL Open Font Licenseに基づいて配布されます)
- Segoe UI Historic (Windows 10 以降にプリインストールされています)
