H100 80GB 能跑 gpt-oss-120b 吗?
⚠️ 紧张
gpt-oss-120b @ Q4_K_M · 8K 上下文
显存需求
73.6 GB
可用显存
80.0 GB
显存分解
| 权重(Q4_K_M) | 71.5 GB |
| KV 缓存(8K 上下文) | 0.6 GB |
| 运行时开销 | 1.5 GB |
| 总需求 | 73.6 GB |
按 8K 上下文、fp16 KV 缓存计算。更长上下文需要更多显存——其他参数请用显存计算器。
推荐量化档位
Q4_K_M
估算生成速度
约 804 tok/s @ Q4_K_M
基于官方架构数据与实测 GGUF 文件大小的理论估算,实际速度误差 ±30%。
这张卡能跑好的更小模型
常见问题
- gpt-oss-120b 需要多少显存?
- Q4_K_M、8K 上下文下:权重 71.5GB + KV 缓存 0.6GB + 运行时开销 1.5GB = 共 73.6GB。H100 80GB 可用显存 80.0GB,判定为:勉强装下。
- H100 80GB 跑 gpt-oss-120b 推荐什么量化档?
- 推荐 Q4_K_M——在 8K 上下文、可用显存 80.0GB 内能装下的最高档位。更低的 Q3/Q2 也能装,但质量损失可感知。
- H100 80GB 跑 gpt-oss-120b 有多快?
- Q4_K_M 下约 804 tokens/s(理论估算,实际误差 ±30%)。
数据核实于 2026-08-04