NVIDIA · Ampere Architecture

レンタル NVIDIA GeForce RTX 3090 Ti クラウドで

VRAM 24 GB GDDR6X
帯域幅 1,008 GB/s
FP16 40.0 TFLOPS
FP32 20.0 TFLOPS
TDP 450W
アーキテクチャ Ampere

このGPUモデルの価格データはまだありません。近日中にご確認ください。

NVIDIA GeForce RTX 3090 Ti 技術仕様

製造元 NVIDIA
アーキテクチャ アンペア
VRAM 24 GB GDDR6X
帯域幅 1,008 GB/s
FP16(テンソル) 40.0 TFLOPS
FP32 20.0 TFLOPS
TDP 450W
発売年 2022
セグメント コンシューマー GPU
メモリタイプ GDDR6X

最適用途

Training fine-tuning rendering

よくある質問

NVIDIA GeForce RTX 3090 Tiは何世代目ですか?

NVIDIA GeForce RTX 3090 Tiの仕様書の短縮版:24 GBのGDDR6X1,008 GB/s、40 FP16 TFLOPS、20 FP32 TFLOPS、Ampere2022)、450W。

詳細版:このカードは大規模テンソルの混合精度行列乗算に最適化されており、これはトランスフォーマーのトレーニングと生産推論で求められる性能です。帯域幅はアテンション操作でのスタールを防ぐのに十分で、VRAM容量はCPUメモリへのオフロードを必要とせずに最新のモデルサイズをカバーします。

Review full specs and related comparisons on the NVIDIA GeForce RTX 3090 Ti page.

複数GPUでのNVIDIA GeForce RTX 3090 Tiのスケーリング性能は?

NVIDIA GeForce RTX 3090 Ti の性能概要:40 FP16 TFLOPS、20 FP32 TFLOPS、1,008 GB/s 帯域幅、24 GB VRAM。

実用的なベンチマークに換算すると、7BパラメータのLLMをFP16で合理的なバッチサイズでトレーニングすると、通常は帯域幅より先に計算性能が飽和します。同じモデルのリアルタイムサービングは通常帯域幅制限で、1,008 GB/s の数値に追随します。拡散画像生成ベンチマークは両者の中間に位置し、計算負荷の高いステップはテンソルコアをよく活用し、アテンションブロックは帯域幅にアクセスします。

Review full specs and related comparisons on the NVIDIA GeForce RTX 3090 Ti page.

最高の価値を得るために NVIDIA GeForce RTX 3090 Ti で何を実行すべきですか?

NVIDIA GeForce RTX 3090 Tiが得意とするユースケース:Training, fine-tuning, rendering。このカードの24 GBのVRAM、Ampereテンソルコア、consumerの位置付けは、最新アクセラレータのプレミアムなしでクラウドグレードのハードウェアを必要とするAIチームに適しています。

目安として、モデルがターゲット精度で24 GBのVRAMに収まり、ワークロードがメモリ制約より帯域幅や計算制約である場合、NVIDIA GeForce RTX 3090 Tiは上位クラスにアップグレードするより経済的な選択肢でしょう。

Review full specs and related comparisons on the NVIDIA GeForce RTX 3090 Ti page.

他の GPU と比較する

NVIDIA GeForce RTX 3090 Ti が他の人気クラウド GPU とスペック、価格、可用性でどう比較されるかをご覧ください。