NVIDIA · Ada Lovelace Architecture

เช่า NVIDIA L40 บนคลาวด์

VRAM 48 GB GDDR6
แบนด์วิดท์ 864 GB/s
FP16 181.0 TFLOPS
FP32 90.5 TFLOPS
TDP 300W
สถาปัตยกรรม Ada Lovelace

ยังไม่มีข้อมูลราคาโมเดล GPU นี้ โปรดตรวจสอบอีกครั้งเร็วๆ นี้

สเปคทางเทคนิคของ NVIDIA L40

ผู้ผลิต NVIDIA
สถาปัตยกรรม อาดา เลิฟเลซ
VRAM 48 GB GDDR6
แบนด์วิดท์ 864 GB/s
FP16 (Tensor) 181.0 TFLOPS
FP32 90.5 TFLOPS
TDP 300W
ปีที่เปิดตัว 2023
กลุ่มตลาด ศูนย์ข้อมูล
ประเภทหน่วยความจำ GDDR6

เหมาะสำหรับ

Inference video processing rendering

คำถามที่พบบ่อย

แบนด์วิดท์หน่วยความจำของ NVIDIA L40 เพียงพอสำหรับการใช้งานการอนุมาน LLM ในการผลิตหรือไม่?

เวอร์ชันย่อของแผ่นสเปก NVIDIA L40 : 48 GB GDDR6, 864 GB/s, 181 FP16 TFLOPS, 90.5 FP32 TFLOPS, Ada Lovelace (2023), 300W

เวอร์ชันยาว: การ์ดนี้ถูกปรับแต่งสำหรับการคูณเมทริกซ์ความแม่นยำผสมบนเทนเซอร์ขนาดใหญ่ ซึ่งตรงกับความต้องการของการฝึกอบรมและการถอดรหัสทรานส์ฟอร์เมอร์ในงานจริง ความเร็วแบนด์วิดธ์เพียงพอที่จะหลีกเลี่ยงการหยุดชะงักในงาน attention และความจุ VRAM ครอบคลุมขนาดโมเดลสมัยใหม่โดยไม่ต้องถ่ายโอนข้อมูลไปยังหน่วยความจำ CPU

Full specs, benchmarks, and comparisons are on the NVIDIA L40 page.

NVIDIA L40 งานที่จำกัดด้วยหน่วยความจำเทียบกับงานที่จำกัดด้วยการคำนวณ

หัวข้อประสิทธิภาพ NVIDIA L40: 181 FP16 TFLOPS, 90.5 FP32 TFLOPS, แบนด์วิดท์ 864 GB/s, VRAM 48 GB

แปลงเป็นการทดสอบประสิทธิภาพจริง: การฝึกโมเดล LLM ขนาด 7 พันล้านพารามิเตอร์ใน FP16 ด้วยขนาดแบตช์ที่เหมาะสมมักจะเต็มประสิทธิภาพการคำนวณก่อนแบนด์วิดท์; การให้บริการแบบเรียลไทม์บนโมเดลเดียวกันมักถูกจำกัดด้วยแบนด์วิดท์และสอดคล้องกับตัวเลข 864 GB/s การทดสอบการสร้างภาพ diffusion อยู่ระหว่างสองแบบ — ขั้นตอนที่เน้นการคำนวณหนักใช้ tensor cores ได้ดี ขณะที่บล็อก attention ยังคงใช้งานแบนด์วิดท์

Check the NVIDIA L40 page for complete specifications and related GPU matchups.

ทางเลือกของ NVIDIA L40 — ควรพิจารณาอะไรเพิ่มเติม?

NVIDIA L40 เหมาะที่สุดสำหรับงานที่ 48 GB VRAM และ Ada Lovelace tensor cores ของมันเข้ากันได้ดี: Inference, video processing, rendering

ถ้างานของคุณต้องการหน่วยความจำมากกว่านี้อย่างมาก (เช่น การฝึกโมเดลระดับแนวหน้าจากศูนย์) NVIDIA L40 จะมีขนาดเล็กเกินไปและคุณควรเลือกการ์ดระดับ H100/H200/B200 ถ้างานของคุณต้องการน้อยกว่า (เช่น การให้บริการขนาดเล็กบนโมเดล 7B พารามิเตอร์) การ์ดที่ถูกกว่าอย่าง L4 หรือ RTX 4090 อาจคุ้มค่ากว่า สำหรับช่วงกลาง NVIDIA L40 มักเป็นตัวเลือกที่สมเหตุสมผล

Full specs, benchmarks, and comparisons are on the NVIDIA L40 page.

เปรียบเทียบกับ GPU อื่นๆ

ดูว่า NVIDIA L40 เทียบกับ GPU คลาวด์ยอดนิยมอื่นๆ อย่างไรในเรื่องสเปก, ราคา และความพร้อมใช้งาน