
AI 综合应用
Replicate
用一行代码调用开源模型的云 API,按输出量计费,也能部署自己的模型。
资源介绍
Replicate 把开源机器学习模型包成统一的云 API。官网的口号是「用一行代码运行 AI」,你不需要租 GPU、不需要配环境,直接调接口拿结果。除了跑现成模型,它也支持微调和部署自己的模型,还提供 Playground 让你在几个模型之间横向比对输出。
计费方式是它和 GPU 租赁类平台最大的差别。Replicate 按输出量算钱,不按机器时间算。定价页上每个模型各自标价,图像模型按张计,语言模型按 token 计,视频模型按秒计。这对流量不稳定的应用很友好,闲着的时候不产生费用;但如果你的调用量足够大且稳定,自己租卡通常更便宜。
模型覆盖面是它的主要价值。定价页上同时列着 Flux 系列、Ideogram、Recraft、DeepSeek 的推理模型和视频生成模型,换模型只要改一个标识符。要注意的是每个模型价格差异极大,同为图像生成,flux-schnell 和 ideogram-v3-quality 之间差了几倍,做成本预估时必须按实际要用的那个模型算,不能取平均。
适合什么人
想快速接入开源图像、视频和语言模型,且调用量不稳定、不愿自建 GPU 环境的产品团队。
真实使用场景
价格说明
官网定价页(2026-09-08 实测)按模型分别计价,示例:black-forest-labs/flux-dev 每张输出图 0.025 美元,flux-schnell 每 1000 张输出图 3.00 美元,ideogram-ai/ideogram-v3-quality 每张输出图 0.09 美元,recraft-ai/recraft-v3 每张 0.04 美元,deepseek-ai/deepseek-r1 输入每百万 token 3.75 美元、输出每千 token 0.01 美元,视频模型按每秒输出 0.25 美元计。官网提供免费额度用于起步,私有模型另按部署规格计费。
核心特点
限制与注意事项
常见问题
Replicate 和自己租 GPU 比,什么时候更划算?
调用量不稳定的时候。Replicate 按输出计费,没有请求就不花钱,省掉了机器空转的成本和运维。一旦你的调用量稳定到能把一张卡跑满,租卡或者用 RunPod 这类按小时计费的服务通常更便宜,代价是要自己管镜像、扩容和故障。
国内团队用起来有什么障碍?
官网只有英文,支付走国际信用卡,服务器在境外,国内直连的稳定性要自己实测。做国内业务的话,还要注意生成内容的合规审核不在它的服务范围内。
冷启动会拖慢首次调用吗?
会,而且模型越大越明显。长时间没人调用的模型再次请求时要重新加载权重,这段等待在实时交互场景里很致命。对延迟敏感的产品要么保持一定调用频率,要么走它的私有部署把实例常驻,后者要另付费。
来源与核验
本页关于 Replicate 的价格、平台和中文支持都取自下面这些页面,可以自行打开核对。最近一次核验时间是 2026-09-08。官网改版后信息可能变化,以官网当前内容为准。
- replicate.com官网Replicate 官网首页,产品定位与调用示例
- replicate.com定价页官方定价页,2026-09-08 观测到的各模型单价










