PRICE GUIDE · 更新于 2026-09-15 · 作者:A12 算力研究
2026 年 H100 GPU 租赁价格指南:每小时到底多少钱?
H100 是当前大模型训练与推理的主力 GPU,但不同渠道的每小时价格能差 4 倍以上——从 $1.73 到 $7.75。本文解释价格差异的来源、每个平台的真实报价、以及租之前必须算清的隐藏成本。
01H100 每小时价格:全市场对比(2026-09 抓取)
注:Vast/RunPod 价格每小时浮动,上表为 2026-09-15 抓取快照,仅作量级参考;Vast 另有 H100 PCIe 与不同配置档位。传统公有云价为其典型区间。
02为什么同一张 H100 价格差 4 倍?6 个决定性因素
- 验证等级:未验证的散户机器报价最低(Vast $1.73 的起价多来自此类),但可能中断、虚报或直接消失。经过核验 + SLA 承诺的机器贵 30–60%,这是「赌博式的便宜」与「工程化的便宜」的差价。
- 实例类型:可抢占实例(Interruptible)约按需价的 50%,预留实例(Reserved)最高再省 50%。你的负载越灵活,价格越低。
- 供给时段:marketplace 价格随供需实时浮动,闲时(美国深夜、周末)折扣显著。
- 带宽与存储:大模型任务的带宽 + 存储费可能接近 GPU 本身——这是报价单上看不到的部分。
- 区域:不同区域的电价、机房成本与供给量直接反映在价格里。
- SXM vs PCIe:SXM( NVLink 高速互联)版本比 PCIe 版贵 15–40%,多卡训练任务必须 SXM。
03隐藏成本清单:报价之外还要算这些
- 停机存储费:多数平台实例停止后存储照计费(典型 $0.10–0.20/GB/月),只有删除实例才停止——忘记删机是账单刺客第一名。
- 带宽双向计费:上传下载都收费,host 间费率差异大;微调任务拉数据集的成本可能超过计算本身。
- 余额归零的代价:部分平台余额归零直接删机、数据不保;A12 的规则是停机保数据 72 小时。
- 任务失败重试:未验证机器上跑挂一次的训练任务,损失的是数小时 GPU 时间 + 全部前置数据传输。
04怎么估算你的真实总成本
一个实际例子:LoRA 微调 8B 模型,数据集 50GB,每天 8 小时跑 10 天:
- GPU:H100 按需价 × 80 小时 ≈ $239(A12 目标价口径)
- 存储:50GB × $0.10/GB/月 ≈ $5
- 带宽:数据集上传下载各一次 ≈ 视节点费率 $2–10
- 若用可抢占档:GPU 成本直接减半 ≈ $120
把这三项都问清楚的平台,才值得托付生产负载。A12 的计费细则全部前置公开 →
05常见问题
2026-09 的公开市场观察:Vast 起价约 $1.73/hr,但那是未验证散户机,生产负载不建议。经过验证的供给里,Akash $2.71、A12 ≤$2.99(公测目标价)、RunPod $3.49。低于这个区间的报价,请先问验证等级和 SLA。
粗略经验:8B–30B 模型的 LoRA 微调与中等批量推理,A100 80G 的性价比更高(约 H100 价格的 55%);70B 以上模型预训练、多卡 NVLink 聚合训练,选 H100 SXM。RAG 在线服务优先考虑延迟与成本,5090/4090 类消费级反而可能是最优解。
满负荷月成本 = 时价 × 730。H100 满月 ≈ $2,183(A12 目标价口径);实际负载很少满月,按你的日利用率折算,再用可抢占档可再省约一半。A12 GPU 目录的每张卡都标注了参考月成本。
你买的不只是硅片:品牌溢价、层级销售体系、巨额资本开支摊销、资源错配(用不上的冗余也在计价)都包含在刊例价里。GPU marketplace 只做调度与核验层,价格围绕硬件成本与供需出清——
详见 A12 的机制解释。
06结论
2026 年租 H100 的合理区间:验证供给 $2–3.5/hr,追求绝对低价可以到 $1.7 左右但需自担风险,传统云 $8+ 只在合规强约束下值得。A12 的定位是「可承诺的低价」——≤$2.99 的公测目标价 + 五层核验 + SLA 99.9% + 按秒计费。
数据说明:文中各平台价格均为 2026-09-15 从官网公开页面抓取的时点快照,会随供需每小时浮动;A12 价格为公测目标区间(ILLUSTRATIVE),正式定价以官方公告为准。本文不构成任何平台的选择建议,请按自身负载特征自行评估。