Replicate
付费Replicate更新于 2026-07用一行 API 调用云端跑开源模型,是开发者把模型接进产品的低门槛入口。
免费额度与收费
官方文档说部分模型可以先免费跑(有一个 try-for-free 合集),但跑一阵后会要求设置账单;官方未公布具体免费额度数字,本站不编。计费主体是按 GPU 秒计:价格页列出 Nvidia T4 每秒 0.000225 美元(约合每小时 0.81 美元)、L40S 每秒 0.000975 美元(约每小时 3.51 美元)、A100 80GB 每秒 0.0014 美元(约每小时 5.04 美元)、H100 每秒 0.001525 美元(约每小时 5.49 美元)。均为美元。部分模型改按输入输出 token 或按张图计价。支持预付余额或按月后付两种账单方式。
完整入口
- 官网/注册
- replicate.com ↗
- 模型库
- replicate.com/explore ↗分官方模型与社区模型
背后的模型
Replicate 卖的是跑模型的 GPU 时间,自己不训模型;托管的多为开放权重模型,同类对手是 Together AI、Fireworks。
怎么用
一行 API 调云端开源模型,接进产品最省事。图像、视频、语音等各类模型都有现成接口;适合快速给 App 加 AI 功能、按次付费。
Replicate 的模式跟 Together、Fireworks 不太一样:后两者主要托管语言模型按 token 卖,Replicate 则是一个什么模型都能跑的通用模型托管平台,图像生成、视频生成、语音合成、OCR、抠图这类非文本模型是它的强项,首页推荐位常年是 FLUX、Seedream、Seedance 这类图像视频模型。
它的计价逻辑是按 GPU 占用秒数收费,而不是按 token——你租的其实是算力时间,模型跑得快就便宜。平台在无请求时会自动缩容到零、不计费,这是它跟包月租卡最大的区别。少数官方维护的模型改用按 token 或按张图的固定价,可预测性更好。
另一块是 Cog:Replicate 开源的模型容器化工具,把你自己的模型打包后可以部署成同样的 API。私有模型按总在线时长计费(含冷启动与空闲),这点跟公开模型只算实际推理时间不同,自建部署前要算清楚账。