★ 1,110 by SemiAnalysis

DeepSeek R1 — GB300 NVL72 vs H200

Performance per Dollar 性能每美元对比

核心发现 Key Findings

59 tok/s/user 目标交互水平下,GB300 NVL72 每百万Token成本 $0.12,H200 为 $0.93。 GB300 NVL72 在此运行点上的成本效率高出 686%

98 tok/s/user 水平下,GB300 NVL72 达到 $0.29/百万Token,H200 为 $2.66, 成本差距达 832%

提升到 136 tok/s/user 时,GB300 NVL72 为 $1.19/百万Token, H200 为 $9.94,GB300 NVL72 领先 733%

💰 GPU定价 (Owning Hyperscaler)

GB300 NVL72 $2.65/GPU/hr
H200 $1.41/GPU/hr

⚡ 延迟等级 (59 tok/s/user)

GB300 并发用户 ~1402
H200 并发用户 ~133

详细对比数据 Detailed Comparison

指标 Metric 59 tok/s/user 98 tok/s/user 136 tok/s/user
GB300 NVL72 $0.118 / MT $0.286 / MT $1.193 / MT
H200 $0.929 / MT $2.663 / MT $9.940 / MT
成本差距 686% ↑ 832% ↑ 733% ↑
GB300 并发 ~1402 ~578 ~134
H200 并发 ~133 ~6 ~14

关于数据 About the Data

数据基于 DeepSeek R1 模型的真实基准测试结果。价格采用拥有超大规模云服务商的 TCO(总拥有成本)标准化计算。 图表支持切换序列长度、精度和指标,可在 完整延迟+吞吐量对比页面 查看更多详情。