RunPod
付費RunPod更新於 2026-07按需租用 GPU 算力跑訓練與推理,是中小團隊繞開自建機房的算力入口。
免費額度與收費
沒有免費額度,按小時計費、用多少付多少。以下為官網定價頁 Pod 報價(2026 年 7 月 17 日查,美元/小時,單卡價):B300(288GB)7.39;B200(180GB)5.89;H200(141GB)4.39;H100 NVL(94GB)3.19;H100 SXM(80GB)2.99;H100 PCIe(80GB)2.89;RTX Pro 6000(96GB)1.99;A100 SXM(80GB)1.49;A100 PCIe(80GB)1.39;L40S(48GB)0.99;RTX 5090(32GB)0.99;L40(48GB)0.82;RTX 6000 Ada(48GB)0.77;RTX 4090(24GB)0.69;RTX A6000(48GB)0.49;RTX 3090(24GB)0.46;A40(48GB)0.44;L4(24GB)0.39;RTX A5000(24GB)0.27。官網同時列出 Community Cloud 與 Secure Cloud 兩種,但頁面未就兩者分別標價。Serverless 另按用量計價。GPU 雲調價頻繁,請以官網定價頁為準。
完整入口
- 控制台
- console.runpod.io ↗註冊、開機器都在這裡
背後的模型
RunPod 賣的是裸算力,你在上面跑什麼模型自己定——最常見的用法是自部署開源模型,省掉按 token 付費。
怎麼用
按需租 GPU 跑訓練和推理,中小團隊的算力入口。適合臨時要顯示卡、不想買卡建房的人;按秒計費、能選各檔 GPU。
它適合誰:RunPod 自稱 AI 開發者雲,最大特點是單卡起租、按小時計費、門檻低——一塊 RTX A5000 每小時 0.27 美元,一塊 RTX 4090 每小時 0.69 美元,個人跑微調、跑推理試驗的常見選擇。這和 CoreWeave 那種八卡整機起、每小時幾十美元的企業路線是兩個市場。
三條產品線:一是 Cloud GPUs(Pods),持久化的 GPU 例項,分 Reserved(保證容量)與 Spot(更便宜但可被打斷)兩種;二是 Serverless,自動伸縮的 GPU 端點,官網稱閒置時縮容到零、不產生閒置費用,並稱通過 FlashBoot 技術把冷啟動壓到 200 毫秒以內,可從 0 自動擴到數百併發 worker;三是 Instant Clusters,面向訓練和大批次推理的多卡分散式算力,官網稱支援 200 張以上 GPU 同時執行、配 InfiniBand 互聯。另有 RunPod Hub 作為映象市場。
選卡的實話:視訊記憶體決定你能不能跑得動,價格決定你跑不跑得起。同樣 80GB 視訊記憶體,A100 SXM 每小時 1.49 美元、H100 SXM 每小時 2.99 美元,差一倍;若只是跑量化後的中小模型,24GB 的 4090 或 A5000 往往就夠,沒必要上 H100。跑之前先算清模型權重加 KV cache 要多少視訊記憶體。