RunPod
付费RunPod更新于 2026-07按需租用 GPU 算力跑训练与推理,是中小团队绕开自建机房的算力入口。
免费额度与收费
没有免费额度,按小时计费、用多少付多少。以下为官网定价页 Pod 报价(2026 年 7 月 17 日查,美元/小时,单卡价):B300(288GB)7.39;B200(180GB)5.89;H200(141GB)4.39;H100 NVL(94GB)3.19;H100 SXM(80GB)2.99;H100 PCIe(80GB)2.89;RTX Pro 6000(96GB)1.99;A100 SXM(80GB)1.49;A100 PCIe(80GB)1.39;L40S(48GB)0.99;RTX 5090(32GB)0.99;L40(48GB)0.82;RTX 6000 Ada(48GB)0.77;RTX 4090(24GB)0.69;RTX A6000(48GB)0.49;RTX 3090(24GB)0.46;A40(48GB)0.44;L4(24GB)0.39;RTX A5000(24GB)0.27。官网同时列出 Community Cloud 与 Secure Cloud 两种,但页面未就两者分别标价。Serverless 另按用量计价。GPU 云调价频繁,请以官网定价页为准。
完整入口
- 控制台
- console.runpod.io ↗注册、开机器都在这里
背后的模型
RunPod 卖的是裸算力,你在上面跑什么模型自己定——最常见的用法是自部署开源模型,省掉按 token 付费。
怎么用
按需租 GPU 跑训练和推理,中小团队的算力入口。适合临时要显卡、不想买卡建房的人;按秒计费、能选各档 GPU。
它适合谁:RunPod 自称 AI 开发者云,最大特点是单卡起租、按小时计费、门槛低——一块 RTX A5000 每小时 0.27 美元,一块 RTX 4090 每小时 0.69 美元,个人跑微调、跑推理试验的常见选择。这和 CoreWeave 那种八卡整机起、每小时几十美元的企业路线是两个市场。
三条产品线:一是 Cloud GPUs(Pods),持久化的 GPU 实例,分 Reserved(保证容量)与 Spot(更便宜但可被打断)两种;二是 Serverless,自动伸缩的 GPU 端点,官网称闲置时缩容到零、不产生闲置费用,并称通过 FlashBoot 技术把冷启动压到 200 毫秒以内,可从 0 自动扩到数百并发 worker;三是 Instant Clusters,面向训练和大批量推理的多卡分布式算力,官网称支持 200 张以上 GPU 同时运行、配 InfiniBand 互联。另有 RunPod Hub 作为镜像市场。
选卡的实话:显存决定你能不能跑得动,价格决定你跑不跑得起。同样 80GB 显存,A100 SXM 每小时 1.49 美元、H100 SXM 每小时 2.99 美元,差一倍;若只是跑量化后的中小模型,24GB 的 4090 或 A5000 往往就够,没必要上 H100。跑之前先算清模型权重加 KV cache 要多少显存。