NVIDIA · Hopper Architecture

Sewa NVIDIA GH200 Superchip di Awan

VRAM 96 GB HBM3
Lebar Jalur 4,000 GB/s
FP16 989.0 TFLOPS
FP32 494.5 TFLOPS
TDP 700W
Seni Bina Hopper

Tiada data harga tersedia lagi untuk model GPU ini. Sila semak semula tidak lama lagi.

Spesifikasi Teknikal NVIDIA GH200 Superchip

Pengeluar NVIDIA
Seni Bina Hopper
VRAM 96 GB HBM3
Lebar Jalur 4,000 GB/s
FP16 (Tensor) 989.0 TFLOPS
FP32 494.5 TFLOPS
TDP 700W
Tahun Keluaran 2023
Segmen Pusat data
Jenis Memori HBM3

Terbaik Untuk

Large-scale AI training HPC

Soalan Lazim

Adakah NVIDIA GH200 Superchip kad pusat data, profesional, atau pengguna?

NVIDIA GH200 Superchip dibina atas seni bina Hopper dan dihantar dengan 96 GB memori HBM3 pada lebar jalur 4,000 GB/s . Dilancarkan pada 2023, kad ini memberikan 989 FP16 TFLOPS dan 494.5 FP32 TFLOPS pada TDP 700W.

Bagi penyelidik pembelajaran mesin, angka-angka ini diterjemahkan kepada beberapa had praktikal: had VRAM menentukan berat model bahasa besar terbesar yang boleh dimuatkan (dan saiz kelompok maksimum pada panjang urutan tertentu), manakala lebar jalur memori menetapkan had atas untuk inferens berat perhatian. Kelajuan pengiraan paling penting untuk pendaraban matriks padat — pra-latihan, pra-latihan kelompok besar, dan penyebaran.

See the NVIDIA GH200 Superchip page for the full spec sheet and comparisons to related GPUs.

Adakah NVIDIA GH200 Superchip cukup baik untuk inferens pengeluaran?

Jawapan ringkas: NVIDIA GH200 Superchip beroperasi pada 989 TFLOPS FP16 dengan 4,000 GB/s lebar jalur memori. Jawapan panjang bergantung pada apa yang anda jalankan.

Untuk latihan FP16 padat dengan kelompok besar, NVIDIA GH200 Superchip menyaturkan teras tensor dan memberikan hasil hampir puncak FLOPS. Untuk penyajian terikat memori pada model asas konteks panjang, lebar jalur mendominasi — angka 4,000 GB/s lebih penting daripada TFLOPS tajuk utama. Untuk pengiraan saintifik, FP32 pada 494.5 TFLOPS adalah nombor yang relevan dan meletakkan NVIDIA GH200 Superchip sejajar dengan jangkaan HPC kelas Hopper.

Check the NVIDIA GH200 Superchip page for complete specifications and related GPU matchups.

NVIDIA GH200 Superchip untuk perkhidmatan masa nyata — adakah ia sesuai?

Kes penggunaan di mana NVIDIA GH200 Superchip berprestasi baik: Large-scale AI training, HPC. VRAM 96 GB, teras tensor Hopper, dan penempatan data-center kad ini sesuai untuk pasukan AI yang memerlukan perkakasan tahap awan tanpa premium pemecut terbaru.

Peraturan praktikal: jika model anda muat dalam VRAM 96 GB pada ketepatan sasaran anda, dan beban kerja anda terikat lebar jalur atau kuasa pengkomputeran dan bukan memori, NVIDIA GH200 Superchip mungkin pilihan ekonomi yang lebih baik daripada menaik taraf ke tahap lebih tinggi.

Review full specs and related comparisons on the NVIDIA GH200 Superchip page.

Bandingkan dengan GPU Lain

Lihat bagaimana NVIDIA GH200 Superchip dibandingkan dengan GPU awan popular lain dari segi spesifikasi, harga, dan ketersediaan.