背景
Ada Lovelaceアーキテクチャは、2020年にリリースされたAmpereアーキテクチャの後継です。Ada Lovelaceアーキテクチャは、2022年9月20日にGTC 2022の基調講演でNvidiaのCEOであるジェンセン・フアンによって発表され、このアーキテクチャはゲーム、ワークステーション、データセンター向けのNvidiaのGPUを支えています。[ 6 ]
建築の詳細
エイダ・ラブレス建築の建築上の改良点には、以下のものが含まれます。[ 7 ]
- CUDA計算能力 8.9 [ 8 ]
- TSMC 4N プロセス(Nvidia向けにカスタム設計されたもの) - TSMCの通常のN4ノードとは混同しないように。
- FP8、FP16、bfloat16、TensorFloat-32(TF32)、およびスパース性アクセラレーションを備えた第4世代テンソルコア
- 第3世代レイトレーシングコア、同時レイトレーシングとシェーディング、および演算処理
- シェーダー実行順序変更 (SER) [ 9 ]
- Nvidiaビデオエンコーダー/デコーダー(NVENC/NVDEC)8K 10ビット60FPS AV1固定機能ハードウェアエンコーディング[ 10 ] [ 11 ]
- NVLink はサポートされていません[ 12 ] [ 13 ]
ストリーミングマルチプロセッサ(SM)
CUDAコア
各SMには128個のCUDAコアが搭載されています。
RTコア
Ada Lovelace は第 3 世代の RT コアを搭載しています。RTX 4090 は、前世代の RTX 3090 Ti の 84 コアと比較して 128 個の RT コアを搭載しています。これらの 128 個の RT コアは、1 個の RT コアあたり 1.49 TFLOPS で、最大 191 TFLOPS の演算能力を提供できます。[ 14 ] Lovelace アーキテクチャでは、シェーダー実行再順序付け (SER) と呼ばれるレイ トレーシング パイプラインの新しいステージが追加され、Nvidia はレイ トレーシング ワークロードで 2 倍のパフォーマンス向上を実現したと主張しています。[ 6 ]
テンソルコア
Lovelaceの新しい第4世代Tensorコアは、DLSS 3のフレーム生成技術で使用されるAIテクノロジーを実現します。Ampereと同様に、各SMには4つのTensorコアが含まれていますが、LovelaceはSMの数が増えたため、全体としてより多くのTensorコアを搭載しています。
クロック速度
Ada Lovelaceアーキテクチャではクロック速度が大幅に向上しており、RTX 4090の基本クロック速度はRTX 3090 Tiのブーストクロック速度よりも高くなっています。
キャッシュおよびメモリサブシステム
最後に有効化されたAD102 Lovelaceダイは 、96MBのL2キャッシュを備えており、 AmpereベースのGA102ダイの6MBから16倍に増加しています。[ 15 ]大容量のL2キャッシュに素早くアクセスできるGPUは、より低速なGDDRビデオメモリからデータを探すGPUと比較して、レイトレーシングなどの複雑な操作にメリットがあります。重要で頻繁にアクセスされるデータを保存するためにメモリへのアクセスにあまり依存しないということは、大きなL2キャッシュと併用して、より狭いメモリバス幅を使用できることを意味します。
各メモリコントローラは32ビット接続を使用し、最大12個のコントローラを搭載することで、合計384ビットのメモリバス幅を実現します。Lovelaceアーキテクチャは、GDDR6またはGDDR6Xメモリのどちらでも使用できます。GDDR6Xメモリはデスクトップ版GeForce RTX 40シリーズに搭載されていますが、より省電力なGDDR6メモリは、対応するモバイル版およびRTX A6000ワークステーションGPUに使用されています。
電力効率とプロセスノード
Ada Lovelaceアーキテクチャは、前世代のアーキテクチャに比べて低電圧で動作可能です。[ 6 ] Nvidiaは、RTX 4090が前世代のフラッグシップRTX 3090 Tiと同じ450Wで2倍のパフォーマンス向上を実現したと主張しています。[ 16 ]
電力効率の向上は、Lovelaceアーキテクチャで使用される製造ノードの小型化に起因する部分もある。Ada Lovelaceアーキテクチャは、 Nvidia向けにカスタム設計されたプロセスノードであるTSMCの最先端4Nプロセスで製造されている。前世代のAmpereアーキテクチャは、 2018年のSamsungの8nmベースの8Nプロセスノードを使用していたが、これはAmpereの発売時点で2年前のものであった。[ 17 ] [ 18 ] 763億個のトランジスタを搭載したAD102ダイは、 1mm2あたり1億2550万個のトランジスタ密度を持ち、GA102の1mm2あたり4510万個から密度が178%増加している。
エイダ・ラブレスを題材にした製品
消費者
デスクトップ
- GeForce 40シリーズ
- GeForce RTX 4060 (AD107)
- GeForce RTX 4060 Ti (AD106)
- GeForce RTX 4070 (AD104)
- GeForce RTX 4070 SUPER (AD104)
- GeForce RTX 4070 Ti (AD104)
- GeForce RTX 4070 Ti スーパー (AD103)
- GeForce RTX 4080 (AD103)
- GeForce RTX 4080 SUPER (AD103)
- GeForce RTX 4090 D (AD102)
- GeForce RTX 4090 (AD102)
携帯
- GeForce 40シリーズ
- GeForce RTX 4050搭載ノートパソコン(AD107)
- GeForce RTX 4060搭載ノートパソコン(AD107)
- GeForce RTX 4070搭載ノートパソコン(AD106)
- GeForce RTX 4080搭載ノートパソコン(AD104)
- GeForce RTX 4090搭載ノートパソコン(AD103)
プロ
デスクトップワークステーション
- NvidiaワークステーションGPU(旧Quadro)
- Nvidia RTX 2000 Ada 世代 (AD107)
- Nvidia RTX 4000 Ada 世代 (AD104)
- Nvidia RTX 4000 SFF Ada Generation (AD104)
- Nvidia RTX 4500 Ada 世代 (AD104)
- Nvidia RTX 5000 Ada 世代 (AD102)
- Nvidia RTX 5880 Ada Generation (AD102)
- Nvidia RTX 6000 Ada 世代 (AD102)
モバイルワークステーション
- NvidiaワークステーションGPU(旧Quadro)
- Nvidia RTX 500 Ada Generation ノートパソコン (AD107)
- Nvidia RTX 1000 Ada Generation ノートパソコン (AD107)
- Nvidia RTX 2000 Ada Generation ノートパソコン (AD107)
- Nvidia RTX 3000 Ada Generation ノートパソコン (AD106)
- Nvidia RTX 3500搭載Ada Generationノートパソコン(AD104)
- Nvidia RTX 4000 Ada Generation ノートパソコン (AD104)
- Nvidia RTX 5000 Ada Generation ノートパソコン (AD103)
データセンター
- NvidiaデータセンターGPU(旧テスラ)
- Nvidia L4 (AD104)
- Nvidia L40 (AD102)
- Nvidia L40G (AD102)
- Nvidia L40CNX (AD102)
参考文献
- ↑ Freund, Karl (2022年9月20日) 「NvidiaがLovelace GPU、クラウドサービスを発表、H100 GPUと新型ドライブThorを出荷」Forbes。2022年11月18日のオリジナルからアーカイブ。2022年11月18日に取得。
- ↑ Mujtaba, Hassan (2022年9月15日). "Nvidiaの次世代Ada LovelaceゲーミングGPUアーキテクチャ、GeForce RTX 40シリーズに搭載されることが確定" . Wccftech . 2022年10月1日のオリジナルからアーカイブ済み。 2022年11月18日閲覧。
- ↑ 「Nvidia、GeForce RTX 40シリーズでパフォーマンスの飛躍的向上とニューラルレンダリングの新時代到来」。Nvidiaニュースルーム(プレスリリース)。2022年9月20日。2023年3月15日のオリジナルからアーカイブ。 2022年9月20日取得。
- ↑ 「Nvidiaの新しいAda Lovelace RTX GPUがデザイナーとクリエイター向けに登場」。Nvidiaニュースルーム。2022年9月20日。2023年5月29日のオリジナルからアーカイブ。2022年11月18日取得。
- ↑ Machkovec, Sam (2022年9月20日) 「NvidiaのAda Lovelace GPU世代:RTX 4090は1,599ドル、4080は899ドルから」Ars Technica。2023年4月3日のオリジナルからアーカイブ。2022年11月18日取得。
- 1 2 3 Chiappetta, Marco (2022年9月22日). "NVIDIA GeForce RTX 40アーキテクチャ概要:Adaの特別なソースが明らかに" . HotHardware . 2023年6月28日のオリジナルからアーカイブ済み。 2023年4月8日取得。
- ↑ 「NVIDIA Ada Lovelace Architecture」。NVIDIA 。 2022年9月20日。2023年7月2日のオリジナルからアーカイブ済み。2022年9月20日取得。
- ↑ 「CUDA C++ プログラミング ガイド」。docs.nvidia.com。2021年5 月 3 日のオリジナルからアーカイブ済み。2023年4 月 15 日取得。
- ↑ 「シェーダー実行順序の変更によりシェーダーのパフォーマンスとゲーム内フレームレートを向上させる」 NVIDIAテクニカルブログ。2022年10月13日。2023年5月25日のオリジナルからアーカイブ。 2023年4月6日取得。
- ↑ Delgado, Gerardo (2022年9月20日). 「光速の創造性:GeForce RTX 40シリーズグラフィックスカードがゲーマーとクリエイター向けに3Dレンダリング、AI、ビデオエクスポートで最大2倍のパフォーマンスを実現」 . NVIDIA . 2023年6月1日のオリジナルからアーカイブ済み。 2022年9月20日取得。
- ↑ 「Nvidia Video Codec SDK」。NVIDIA Developer。2022年9月20日。2023年3月17日のオリジナルからアーカイブ。 2022年11月18日取得。
- ↑ Chuong Nguyen (2022年9月21日) 「Nvidia、RTX 4090のNVLinkを廃止」Windows Central。2024年4月24日のオリジナルからアーカイブ済み。2023年1月1日に取得。
- ↑ btarunr (2022年9月21日)。「ジェンセン氏が確認:Ada LovelaceのNVLinkサポートは廃止」。TechPowerUp 。 2022年10月18日のオリジナルからアーカイブ。2022年11月18日に取得。
- ↑ 「Nvidia Ada Lovelace GPUアーキテクチャ:優れたゲームとクリエイティング、プロフェッショナルグラフィックス、AI、およびコンピューティングパフォーマンスを実現するように設計されています」(PDF)。Nvidia。30ページ。2023年7月4日にオリジナルからアーカイブ(PDF) 。 2023年4月5日に取得。
- ↑ 「Nvidia Ada Lovelace GPUアーキテクチャ:優れたゲームとクリエイティング、プロフェッショナルグラフィックス、AI、およびコンピューティングパフォーマンスを実現するように設計されています」(PDF)。Nvidia。p . 12。2023年7月4日のオリジナルからアーカイブ(PDF) 。 2023年4月6日取得。
- ↑ 「Nvidia Ada Lovelace GPUアーキテクチャ:優れたゲームとクリエイティング、プロフェッショナルグラフィックス、AI、およびコンピューティングパフォーマンスを実現するように設計されています」(PDF)。Nvidia。p . 12。2023年7月4日のオリジナルからアーカイブ(PDF) 。 2023年4月5日に取得。
- ↑ James, Dave (2020年9月1日). 「Nvidia、RTX 3090、RTX 3080、RTX 3070にSamsungの8nmプロセスを採用することを確認」 . PC Gamer . 2023年4月13日のオリジナルからアーカイブ済み。 2023年4月5日取得。
- ↑ Bosnjak, Dominik (2020年9月1日)。「NVIDIAの驚異的なAmpereカードの中核をなすSamsungの旧8nm技術」。SamMobile 。 2023年4月7日のオリジナルからアーカイブ済み。 2023年4月5日取得。
- ↑ 「Nvidia Ada Lovelace GPUアーキテクチャ:優れたゲームとクリエイティング、プロフェッショナルグラフィックス、AI、およびコンピューティングパフォーマンスを実現するように設計されています」(PDF)。Nvidia。p . 25。2023年7月4日のオリジナルからアーカイブ(PDF) 。 2023年4月5日に取得。
- ↑ムタナ、プラタップ。ミシュラ、サンプルナナンダ。パタイト、アビジット(2023年1月18日)。「AV1 と NVIDIA Ada Lovelace アーキテクチャによるビデオの品質とパフォーマンスの向上」。Nvidia 開発者。2023 年 5 月 20 日のオリジナルからアーカイブ。2023 年4 月 5 日に取得。
- ↑ 「Nvidia Ada Science: Ada が DLSS 3 でグラフィックスの科学をどのように進歩させるか」(PDF)。Nvidia。p . 13。2023年 3月24 日にオリジナルからアーカイブ(PDF) 。2023年4 月 5 日に取得。
- ↑ Garreffa, Anthony (2022年9月25日). 「NVIDIAの次世代GeForce RTX 40シリーズにはDP2.0接続機能がないなんて、ばかげてる」 . TweakTown . 2023年4月6日のオリジナルからアーカイブ済み。 2023年4月5日取得。
- ↑ Judd, Will (2022年11月3日). 「AMD、FSR 3搭載の7900 XTXおよび7900 XTグラフィックスカードを発表」 . Eurogamer . 2023年4月5日のオリジナルよりアーカイブ。 2023年4月5日閲覧。
- ↑ 「NVIDIAがAda 102/103/104 GPUの仕様を確認、AD104はGA102よりもトランジスタ数が多い」。VideoCardz 。 2022年9月23日。2023年6月3日のオリジナルからアーカイブ。 2022年9月23日取得。
- ↑ 「NVIDIA AD102 GPUの仕様」。TechPowerUp。2022年12月17日取得。
- ↑ 「NVIDIA AD103 GPU の仕様」。TechPowerUp。2024年7月16日取得。
- ↑ 「NVIDIA AD104 GPU の仕様」。TechPowerUp。2022年10月18日取得。
- ↑ 「NVIDIA AD106 GPUの仕様」。TechPowerUp。2022年12月17日取得。
- ↑ 「NVIDIA AD107 GPUの仕様」。TechPowerUp。2022年12月17日取得。
- ↑ 「NVIDIA L4 仕様」 . TechPowerUp . 2023年3月21日. 2024年4月15日取得.
外部リンク
- NVIDIA ADA GPUアーキテクチャに関するホワイトペーパー