| Tesla P40 | 24 GB | 11.76 T | 11.76 T | 初期の Pascal アーキテクチャをベースとしており、大容量メモリを必要とし、cuda 11.x より前のバージョンを使用するタスクに適しています。 |
| TITAN XP | 12 GB | 12.15 T | 12.15 T | Pascal アーキテクチャの旧モデルで、初心者に適したエントリーレベルの選択肢です。 |
| 1080 Ti | 11 GB | 11.34 T | 11.34 T | TITAN XP と同じ世代の製品で、エントリーレベルのユーザーに適していますが、11 GB のメモリは場合によっては制約となる可能性があります。 |
| 2080Ti | 11 GB | 13.45 T | 53.8 T | Turing アーキテクチャの GPU で、優れた性能を提供し、特に混合精度計算シナリオに適しており、高いコストパフォーマンスを備えています。 |
| V100 | 16/32 GB | 15.7 T | 125 T | プロフェッショナルなコンピューティングシナリオ向けに設計されたハイエンド製品で、特に高い半精度計算を必要とするタスクに適しており、前世代のコンピュートカードをリードする存在です。 |
| 3060 | 12 GB | 12.74 T | About 24 T | 1080 Ti のメモリが要件を満たさない場合、3060 は優れた代替案となります。特に初心者に適しており、cuda 11.x の使用が必要です。 |
| A4000 | 16 GB | 19.17 T | About 76 T | メモリと計算能力のバランスが取れており、中級ユーザーに適しています。cuda 11.x 環境の使用が必要です。 |
| 3080Ti | 12 GB | 34.10 T | About 70 T | 優れた性能出力により、極端な大容量メモリを必要としないシナリオに理想的な選択肢です。cuda 11.x の使用が必要です。 |
| A5000 | 24 GB | 27.77 T | About 117 T | 高性能 GPU で、大容量メモリと高い半精度計算能力を必要とするシナリオに適しています。cuda 11.x の使用が必要です。 |
| 3090 | 24 GB | 35.58 T | About 71 T | 優れた性能とメモリ容量を提供し、幅広いアプリケーションシナリオに適しています。コストパフォーマンスを重視する場合の第一候補です。cuda 11.x の使用が必要です。 |
| A40 | 48 GB | 37.42 T | 149.7 T | 非常に大きなメモリ容量を備え、計算能力は 3090 に近く、極めて高いメモリ要件を持つ計算タスクに適しています。cuda 11.x の使用が必要です。 |
| A100 SXM4 | 40/80 GB | 19.5 T | 312 T | トップクラスのプロフェッショナル向けコンピューティング GPU で、大容量メモリと半精度計算能力を備え、最も複雑な計算タスクに適しています。NVLink をサポートし、マルチカード並列計算向けに最適化されています。cuda 11.x の使用が必要です。 |
| 4090 | 24 GB | 82.58 T | 165.2 T | 新世代の高性能 GPU で、優れた単精度および半精度計算能力を提供し、高いコストパフォーマンスを求めるシナリオに適しています。メモリが比較的小さいことを除けば、目立った欠点はほとんどありません。 |