Unicode 標準では、ラテン文字の 1000 文字以上がエンコードされており、いくつかの基本ラテンブロックと拡張ラテンブロックにグループ化されています。拡張範囲には、主に合成済み文字と、結合ダイアクリティカルマークで同等にエンコードされるダイアクリティカルマーク、およびさまざまなアフリカ言語の正書法で使用される合字と個別の文字 ( Latin Extended-B のクリック記号を含む) やベトナム語アルファベット(Latin Extended Additional) が含まれています。Latin Extended-C には、ウイグル語とクラウディウス文字の追加が含まれています。Latin Extended-D は、中世文字が顕著なカテゴリである雑多な文字で構成されています。Latin Extended-E は、主にドイツ語方言 ( Teuthonista ) で使用される文字で構成されています。[ 1 ] Latin Extended-F と -G には、音声転写用の文字が含まれています。
Unicode標準のバージョン17.0の時点で、次の19ブロックの1,492文字がラテン文字に分類されています。[ 2 ]
さらに、通貨記号、制御画像、CJK互換性、囲まれた英数字、囲まれたCJK文字と月、数式英数字記号、囲まれた英数字補足ブロックには、ラテン文字に似た文字が多数エンコードされていますが、それらはグラフィカルにはラテン文字であるものの、スクリプトプロパティがcommonであるため、Unicodeの用語ではラテン文字には属しません。リス語もほぼ完全にラテン文字で構成されていますが、独自のスクリプトプロパティを使用しています。
この表では、 Unicodeスクリプトプロパティがラテン文字である文字は色付きで強調表示され、その文字が導入されたUnicodeのバージョンを示しています。予約済みのコードポイント(将来的に文字として割り当てられる可能性のあるもの)は灰色の背景で表示されます。ラテン文字に属さない文字はすべて白い背景で表示されます(そのため、導入されたUnicodeのバージョンは表示されません)。