NVIDIA · Ada Lovelace Architecture

Huur NVIDIA L40 in de Cloud

VRAM 48 GB GDDR6
Bandbreedte 864 GB/s
FP16 181.0 TFLOPS
FP32 90.5 TFLOPS
TDP 300W
Architectuur Ada Lovelace

Nog geen prijsgegevens beschikbaar voor dit GPU-model. Kom binnenkort terug.

NVIDIA L40 Technische Specificaties

Fabrikant NVIDIA
Architectuur Ada Lovelace
VRAM 48 GB GDDR6
Bandbreedte 864 GB/s
FP16 (Tensor) 181.0 TFLOPS
FP32 90.5 TFLOPS
TDP 300W
Jaar van Uitgave 2023
Segment Datacenter
Geheugentype GDDR6

Beste Voor

Inference video processing rendering

Veelgestelde Vragen

Is de geheugenbandbreedte van NVIDIA L40 voldoende voor LLM-productie-inferentie?

Korte versie van het NVIDIA L40 specificatieblad: 48 GB GDDR6, 864 GB/s, 181 FP16 TFLOPS, 90.5 FP32 TFLOPS, Ada Lovelace (2023), 300W.

Lange versie: de kaart is geoptimaliseerd voor mixed-precision matrixvermenigvuldiging op grote tensors, wat precies is wat transformer training en productie-inferentie vragen. De bandbreedte is ruim voldoende om stalling bij aandachtoperaties te voorkomen, en de VRAM-capaciteit dekt moderne modelgroottes zonder dat offloading naar CPU-geheugen nodig is.

Full specs, benchmarks, and comparisons are on the NVIDIA L40 page.

NVIDIA L40 geheugen-gebonden versus reken-gebonden workloads

NVIDIA L40 prestatiehoogtepunt: 181 FP16 TFLOPS, 90.5 FP32 TFLOPS, 864 GB/s bandbreedte, 48 GB VRAM.

Omgezet in praktische benchmarks: modeltraining van een 7B-parameter LLM in FP16 met redelijke batchgroottes verzadigt meestal eerst de rekenkracht voor de bandbreedte; real-time serving op hetzelfde model is meestal bandbreedte-beperkt en volgt de 864 GB/s waarde. Diffusie beeldgeneratie benchmarks zitten tussen beide in — rekenintensieve stappen benutten tensor cores goed, terwijl attention blokken nog steeds bandbreedte gebruiken.

Check the NVIDIA L40 page for complete specifications and related GPU matchups.

NVIDIA L40 alternatieven — wat moet ik nog meer overwegen?

NVIDIA L40 is het beste voor workloads waarbij zijn 48 GB VRAM en Ada Lovelace tensor cores goed op elkaar zijn afgestemd: Inference, video processing, rendering.

Als uw workload aanzienlijk meer geheugen nodig heeft (bijv. training van grensverleggende modellen vanaf nul), is NVIDIA L40 te klein en wilt u een kaart van het H100/H200/B200-klasse. Als uw workload minder nodig heeft (bijv. kleinschalige serving op 7 miljard parameters modellen), kunnen goedkopere kaarten zoals L4 of RTX 4090 kostenefficiënter zijn. Voor het middensegment is NVIDIA L40 meestal de verstandige keuze.

Full specs, benchmarks, and comparisons are on the NVIDIA L40 page.

Vergelijk met andere GPUs

Bekijk hoe NVIDIA L40 zich verhoudt tot andere populaire cloud-GPU's qua specificaties, prijzen en beschikbaarheid.