インド情報交換用文字コード(ISCII)は、インドの様々な文字体系を表すための符号化方式です。主要なインド文字とローマ字の翻字を符号化します。サポートされている文字は、ベンガル語・アッサム語、デーヴァナーガリー文字、グジャラート語、グルムキー文字、カンナダ語、マラヤーラム語、オリヤー語、タミル語、テルグ語です。ISCIIはペルシア語に基づくインドの文字体系を符号化しませんが、文字体系切り替えコードにより、カシミール語、シンド語、ウルドゥー語、ペルシア語、パシュトー語、アラビア語に対応しています。ペルシア語に基づく文字体系は、後にPASCIIエンコーディングで符号化されました。
ISCIIは一部の政府機関以外では広く使用されていませんが、 ATRメカニズムのないバリアントがクラシックMac OSのMac OS Devanagariで使用されていました[ 1 ]。現在ではUnicodeによってほぼ廃止されています。Unicodeは各インド系文字体系に個別のブロックを使用し、各ブロック内でISCIIのレイアウトをほぼそのまま保持しています[ 2 ]: 462
ブラーフミー文字から派生した文字体系は、同様の構造を持っています。[ 2 ] : 462そこで、ISCII は、同じ音価を持つ文字を同じコード ポイントにエンコードし、さまざまな文字体系を重ね合わせます。たとえば、ISCII コード 0xB3 0xDB は [ki] を表します。これは、マラヤーラム語では കി、デーヴァナーガリー文字では कि、グルムキー文字では ਕਿ、タミル語では கி と表示されます。文字体系は、リッチ テキストではマークアップによって、プレーン テキストでは以下に説明するATRコードによって選択できます。
単一のエンコーディングを使用する動機の一つは、ある表記体系から別の表記体系への容易な音訳を可能にするという考え方である。[ 2 ]: 462しかし、互換性の問題が多すぎるため、これは実際には実用的な考え方ではない。
ISCII は 8 ビットのエンコーディングです。[ 3 ] : 4下位 128 個のコード ポイントはプレーンASCIIで、上位 128 個のコード ポイントは ISCII 固有です。文字を表すコード ポイントに加えて、ISCII では、次のバイトに 2 種類の情報のいずれかが含まれていることを示すニーモニックATRを持つコード ポイントを使用します。1 つの値のセットは、次の書き方システム インジケータまたは行末まで書き方システムを変更します。もう 1 つの値のセットは、太字や斜体などの表示モードを選択します。ISCII では、デフォルトの書き方システムを示す手段は提供されていません。
次の表は、デーヴァナーガリー文字の文字セットを示しています。アッサム語、ベンガル語、グジャラート語、グルムキー語、カンナダ語、マラヤーラム語、オリヤー語、タミル語、テルグ語のコードセットは類似しており、デーヴァナーガリー文字の各形式は、それぞれの表記体系の同等の形式に置き換えられています[ 2 ]: 462。各文字は、10進コードとUnicode相当値とともに表示されています。
Unicode(UTF-8)からISCII/ANSIコードに変換するには、以下のコードページを使用できます。