NVIDIA · Ampere Architecture

Wypożycz NVIDIA GeForce RTX 3080 w chmurze

VRAM 10 GB GDDR6X
Przepustowość 760 GB/s
FP16 29.8 TFLOPS
FP32 14.9 TFLOPS
TDP 320W
Architektura Ampere

Brak danych cenowych dla tego modelu GPU. Sprawdź ponownie wkrótce.

Specyfikacje techniczne NVIDIA GeForce RTX 3080

Producent NVIDIA
Architektura Ampere
VRAM 10 GB GDDR6X
Przepustowość 760 GB/s
FP16 (Tensor) 29.8 TFLOPS
FP32 14.9 TFLOPS
TDP 320W
Rok wydania 2020
Segment GPU konsumenckie
Typ pamięci GDDR6X

Najlepsze do

Gaming inference

Najczęściej Zadawane Pytania

Jaką pamięć wykorzystuje NVIDIA GeForce RTX 3080 (HBM, GDDR)?

NVIDIA GeForce RTX 3080 oferuje 10 GB pamięci GDDR6X z przepustowością 760 GB/s, dostarcza 29.8 TFLOPS mocy obliczeniowej FP16 i działa przy 320W. Bazuje na architekturze Ampere, wprowadzonej w 2020.

Dla większości zastosowań AI ma to znaczenie w trzech aspektach: 1) jak duży model można załadować; 2) jak szybko działa uwaga (ograniczona przepustowością); 3) jak szybko działają operacje intensywnie wykorzystujące mnożenie macierzy (ograniczone mocą obliczeniową). NVIDIA GeForce RTX 3080 zwykle znajduje się w zrównoważonym punkcie we wszystkich trzech — dlatego pojawia się wielokrotnie w katalogach chmurowych skierowanych do zespołów ML.

Check the NVIDIA GeForce RTX 3080 page for complete specifications and related GPU matchups.

Czy NVIDIA GeForce RTX 3080 jest szybszy niż A100 w fine-tuningu?

Surowa moc obliczeniowa NVIDIA GeForce RTX 3080 osiąga szczyt 29.8 TFLOPS FP16 i 14.9 TFLOPS FP32, z przepustowością pamięci 760 GB/s zasilającą jednostki obliczeniowe. Architektura Ampere wprowadza rdzenie tensorowe zoptymalizowane pod mieszane precyzje BF16/FP16 / FP8 — formaty najważniejsze dla nowoczesnych transformatorów.

Rzeczywista przepustowość treningu modeli skaluje się blisko teoretycznych szczytów przy dużych wsadach; mniejsze wsady są ograniczone przepustowością pamięci. Dla niskoopóźnieniowego wnioskowania liczba tokenów na sekundę na transformatorach takich jak Llama 70B zależy w dużym stopniu od strategii kwantyzacji — FP8/INT8 odblokowują limit obliczeniowy, FP16 jest ograniczone przepustowością.

The NVIDIA GeForce RTX 3080 page has the complete datasheet and side-by-side comparisons.

Alternatywy dla NVIDIA GeForce RTX 3080 — co jeszcze powinienem rozważyć?

NVIDIA GeForce RTX 3080 jest najlepszy do zadań, gdzie jego 10 GB VRAM i Ampere tensor cores są dobrze dopasowane: Gaming, inference.

Jeśli Twoje zadanie wymaga znacznie więcej pamięci (np. trening modeli frontier od podstaw), NVIDIA GeForce RTX 3080 jest za mały i lepiej wybrać kartę klasy H100/H200/B200. Jeśli potrzebujesz mniej (np. małoskalowa obsługa modeli 7-miliardowych parametrów), tańsze karty jak L4 lub RTX 4090 mogą być bardziej opłacalne. Dla średniej półki, NVIDIA GeForce RTX 3080 jest zwykle rozsądnym wyborem.

See the NVIDIA GeForce RTX 3080 page for the full spec sheet and comparisons to related GPUs.

Porównaj z innymi GPU

Zobacz, jak NVIDIA GeForce RTX 3080 wypada na tle innych popularnych GPU w chmurze pod względem specyfikacji, cen i dostępności.