本文根据 Replicate 官网与定价页整理,资料核对于 2026-10-11。模型与价格变化快,以官网为准。
是什么
Replicate 是一个「运行机器学习模型」的平台。它托管了数千个社区贡献的开源模型,也有一部分闭源的商业模型。每个模型都有自己的页面:上面是一个可以直接填参数试用的表单,下面是对应的 API 调用代码。
它最受欢迎的场景是图像、视频、音频这类生成模型:新模型在开源社区一出来,往往很快就有人打包上传到 Replicate,开发者不用配环境、不用找显卡就能试用和集成。
能做什么
- 调用现成模型:文生图、图生视频、语音合成、语音识别、放大修复、大语言模型等。
- 部署自己的模型:用官方开源的打包工具 Cog 把模型封装后推送上去,得到一个可伸缩的 API。
- 微调:对部分模型做微调并托管。
- 私有模型与专属硬件:私有模型多数运行在独占硬件上。
怎么上手
- 在 replicate.com 注册并登录。
- 在模型页的网页表单里先试几次,确认效果。
- 在账户设置里创建 API Token,复制模型页给出的示例代码(提供 Python、Node.js、HTTP 等写法)。
- 生成类任务通常是异步的:提交后拿到一个预测 ID,轮询或用 Webhook 获取结果。
免费与付费
没有月费,按用量计费,有两种计价方式(官网定价页,美元,2026-10 查询):
- 按运行时间:大多数公开模型按秒计费,单价取决于硬件。例如小型 CPU 为每秒 0.000025 美元,Nvidia H100 GPU 为每秒 0.001525 美元。
- 按输入输出:部分模型按产出计价。定价页的例子:flux-1.1-pro 每张图 0.04 美元,flux-dev 每张图 0.025 美元,wan-2.1-i2v-480p 每秒视频 0.09 美元。
私有模型运行在独占硬件上时,启动、空闲和运行时间都计费;快速启动的微调模型只按实际运行时间计费。大用量可以通过企业合同获得折扣。定价页没有写明免费额度。
适合谁 / 不适合谁
适合:
- 想快速把开源生成模型接进自己产品或工作流的开发者;
- 需要尝试大量不同模型来做选型的团队;
- 有自己的模型、想省掉部署和扩缩容工作的人。
不适合:
- 不写代码、只想在线生成图片的用户,各种成品应用更合适;
- 调用量巨大且固定的业务,长期看自建或包 GPU 可能更便宜;
- 对延迟极其敏感的实时应用——冷启动可能需要等待。
注意事项
- 冷启动:不常用的模型第一次调用需要加载,时间可能较长,按时间计费的模型这段也可能计入。
- 社区模型质量参差:上传者不同,维护状况不一,生产使用前固定模型版本号。
- 模型许可证:每个模型的许可不同,有的禁止商用,接入前看模型页。
- 输出文件不会永久保存:生成结果的链接有有效期,拿到后尽快转存到自己的存储。
0 条评论
还没有评论,来抢沙发~