常用 GPU 型号(RTX 4090 / A100 / H100 / B200)
Common Training / Inference GPUs (RTX 4090 / A100 / H100 / B200)常用训练和部署具身模型最常见的几款英伟达显卡,差别主要在显存和算力
这是具身智能论文和代码仓库里最常出现的几款英伟达 GPU。RTX 4090(Ada 架构,24 GB 显存)是消费级游戏卡,常用来做单机推理和小规模微调;A100(Ampere 架构,40 / 80 GB)和 H100(Hopper 架构,80 GB,支持 FP8)是数据中心卡,多卡互联后用于预训练和全参数微调;B200(Blackwell 架构)单卡显存最高约 180 GB,8 卡的 DGX B200 合计约 1.4 TB 显存。选卡先看显存,它决定能放下多大的模型和批大小,再看算力、支持的数值精度和卡间互联带宽。机器人本体上跑模型一般用 Jetson 这类端侧芯片,而不是这些卡。
例子openpi 仓库给出的参考:π0 推理需要 8 GB 以上显存、LoRA 微调需要 22.5 GB 以上,RTX 4090 都够用;全参数微调需要 70 GB 以上,要用 A100 80GB 或 H100。
- 也叫
- 4090、A100、H100、B200
- 相关
- GPU 显存、英伟达 Jetson、低秩适配、全参数微调、数值精度格式(FP32 / FP16 / BF16 / FP8 / INT8 / INT4)、AutoDL(GPU 算力租用平台)
- 来源
- openpi README(Hardware Requirements)
NVIDIA DGX B200 User Guide: Introduction - 信息截至
- 2026-09