读懂AI时代 Read AI Time 读懂AI时代 Read AI Time 繁體

Replicate

付费Replicate更新于 2026-07

用一行 API 调用云端跑开源模型,是开发者把模型接进产品的低门槛入口。

免费额度与收费

官方文档说部分模型可以先免费跑(有一个 try-for-free 合集),但跑一阵后会要求设置账单;官方未公布具体免费额度数字,本站不编。计费主体是按 GPU 秒计:价格页列出 Nvidia T4 每秒 0.000225 美元(约合每小时 0.81 美元)、L40S 每秒 0.000975 美元(约每小时 3.51 美元)、A100 80GB 每秒 0.0014 美元(约每小时 5.04 美元)、H100 每秒 0.001525 美元(约每小时 5.49 美元)。均为美元。部分模型改按输入输出 token 或按张图计价。支持预付余额或按月后付两种账单方式。

完整入口

官网/注册
replicate.com ↗
模型库
replicate.com/explore ↗分官方模型与社区模型
价格页
replicate.com/pricing ↗
文档
replicate.com/docs ↗

背后的模型

Replicate 卖的是跑模型的 GPU 时间,自己不训模型;托管的多为开放权重模型,同类对手是 Together AI、Fireworks。

怎么用

一行 API 调云端开源模型,接进产品最省事。图像、视频、语音等各类模型都有现成接口;适合快速给 App 加 AI 功能、按次付费。

Replicate 的模式跟 Together、Fireworks 不太一样:后两者主要托管语言模型按 token 卖,Replicate 则是一个什么模型都能跑的通用模型托管平台,图像生成、视频生成、语音合成、OCR、抠图这类非文本模型是它的强项,首页推荐位常年是 FLUX、Seedream、Seedance 这类图像视频模型。

它的计价逻辑是按 GPU 占用秒数收费,而不是按 token——你租的其实是算力时间,模型跑得快就便宜。平台在无请求时会自动缩容到零、不计费,这是它跟包月租卡最大的区别。少数官方维护的模型改用按 token 或按张图的固定价,可预测性更好。

另一块是 Cog:Replicate 开源的模型容器化工具,把你自己的模型打包后可以部署成同样的 API。私有模型按总在线时长计费(含冷启动与空闲),这点跟公开模型只算实际推理时间不同,自建部署前要算清楚账。

常见问题

Replicate官网是什么?
官网是 replicate.com,注册即在同一站点,模型库在 replicate.com/explore,价格页在 replicate.com/pricing。
Replicate免费吗?
有限免费。官方文档说部分模型可以先免费试跑,但用一阵后会要求设置账单,官方没有公布具体免费额度数字。正式使用按 GPU 占用秒数计费,例如 H100 每秒 0.001525 美元。
Replicate 是按 token 计费吗?
多数模型不是。Replicate 主要按 GPU 占用的秒数计费,模型跑得越快越便宜,没有请求时缩容到零不计费。少数官方维护的模型改用按 token 或按张图的固定价格。
Replicate 能跑自己的模型吗?
可以。用它开源的 Cog 工具把模型打包成容器后部署即可。但私有模型按总在线时长计费,包含冷启动和空闲时间,跟公开模型只算推理时间的算法不同。

← 返回 AI 工具精选