NVIDIA · Ampere Architecture

租用 NVIDIA GeForce RTX 3080 云端 GPU

VRAM 10 GB GDDR6X
带宽 760 GB/s
FP16 29.8 TFLOPS
FP32 14.9 TFLOPS
TDP 320W
架构 Ampere

该GPU型号暂无价格数据。请稍后再查。

NVIDIA GeForce RTX 3080 技术规格

制造商 NVIDIA
架构 安培
显存 10 GB GDDR6X
带宽 760 GB/s
FP16(张量) 29.8 TFLOPS
FP32 14.9 TFLOPS
热设计功耗 320W
发布年份 2020
细分市场 消费级 GPU
内存类型 GDDR6X

适用场景

Gaming inference

常见问题

NVIDIA GeForce RTX 3080 使用什么类型的内存(HBM,GDDR)?

NVIDIA GeForce RTX 3080 配备 10 GB 的 GDDR6X,带宽为 760 GB/s,FP16 计算性能为 29.8 TFLOPS,功耗为 320W。基于 Ampere 架构,该架构于 2020 发布。

对于大多数 AI 应用,这体现在三个方面:1)可加载的模型大小;2)注意力运行速度(受带宽限制);3)以矩阵乘法为主的操作速度(受计算能力限制)。NVIDIA GeForce RTX 3080 在这三方面通常保持平衡——这也是它频繁出现在面向机器学习团队的云产品目录中的原因。

Check the NVIDIA GeForce RTX 3080 page for complete specifications and related GPU matchups.

NVIDIA GeForce RTX 3080 微调速度是否比 A100 快?

NVIDIA GeForce RTX 3080 的原始计算峰值为 29.8 FP16 TFLOPS 和 14.9 FP32 TFLOPS,内存带宽为 760 GB/s,供给计算单元。Ampere 架构配备针对 BF16/FP16 / FP8 混合精度优化的张量核心——这些格式对现代变换器尤为重要。

实际模型训练吞吐量在大批量时接近理论峰值;小批量受内存带宽限制。低延迟推理时,像 Llama 70B 这样的变换器令牌处理速度高度依赖量化策略——FP8/INT8 可解锁计算上限,FP16 受带宽限制。

The NVIDIA GeForce RTX 3080 page has the complete datasheet and side-by-side comparisons.

NVIDIA GeForce RTX 3080 替代方案 — 我还应该考虑什么?

NVIDIA GeForce RTX 3080最适合其10 GB显存和Ampere张量核心相匹配的工作负载:Gaming, inference

如果你的工作负载需要显著更多内存(例如,从零开始训练前沿规模模型),NVIDIA GeForce RTX 3080容量不足,你需要选择H100/H200/B200级别的显卡。如果你的工作负载需求较少(例如,7B参数模型的小规模服务),像L4或RTX 4090这样的更便宜显卡可能更具成本效益。对于中间区间,NVIDIA GeForce RTX 3080通常是合理的选择。

See the NVIDIA GeForce RTX 3080 page for the full spec sheet and comparisons to related GPUs.

与其他 GPU 比较

查看 NVIDIA GeForce RTX 3080 在规格、价格和可用性方面与其他热门云 GPU 的对比。