H200 141GB
更大的 HBM3e 显存适合长上下文推理、大模型训练和显存需求较高的计算任务。
架构Hopper
显存141GB HBM3e
区域芬兰
当前配置1 / 2 卡
适用场景
适合单卡显存超过 80GB 的模型推理、训练和科学计算。更大的显存可减少部分任务中的模型切分,但仍需按模型精度和上下文长度估算显存。
配置说明
后台当前提供 SXM5 配置。多卡组合会随库存变化,页面只展示产品能力,实时可用配置以控制台为准。
H200 与 H100
| 项目 | H200 | H100 |
|---|---|---|
| 单卡显存 | 141GB HBM3e | 80GB HBM3 |
| 更适合 | 大显存、长上下文、高并发推理 | 训练与推理的通用高性能配置 |
| 选择重点 | 显存容量和带宽 | 配置范围和预算 |
实际使用判断
长上下文推理
KV Cache 占用会随上下文长度和并发增加,141GB 显存能给部署留出更多空间。
大模型微调
仍需考虑权重、梯度、优化器状态和激活值,不能仅凭模型文件大小判断。
科学计算
大规模网格、矩阵和中间结果对显存容量与带宽敏感时,可优先测试 H200。
常见问题
141GB 显存能否完整运行某个模型?
需要结合精度、量化方式、上下文长度、批量大小和推理框架计算,建议用真实任务测试。
当前有哪些卡数组合?
当前后台有单卡和双卡可用记录;其他组合可能存在但处于无库存状态。
什么时候不必选择 H200?
如果任务能稳定运行在 80GB 内,且更关注单位小时成本,H100 或 A100 可能更合适。
硬件规格参考:NVIDIA H200 产品资料。
最终费用取决于卡数、CPU、内存、系统盘和数据盘配置。