API中转站评测
← 返回官转中转站

Replicate 怎么用?replicate.com 价格、免费额度与国内充值

30 秒结论:推荐,但它多半不是你以为的那种东西。 Replicate 不是中转站——OpenAI、Anthropic、Google、字节跳动、阿里、MiniMax 都在它上面开了自己的命名空间,挂着带 Official 标记的模型openai/gpt-image-2anthropic/claude-opus-4.7bytedance/seedream-5-litealibaba/happyhorse-1.0),价格就是官方价,不打折。它真正的用途也不是跑 Claude Code:本站在它的模型页上抄下的运行次数说明了一切——图像模型 gpt-image-2 一千七百九十万次、nano-banana-2 一千五百八十万次,而 claude-opus-4.7 只有二十二万次换句话说:文本对话你该用中转站,出图、出视频、出音乐才是来这儿的理由。 计费方式也和中转站完全不同,三套并存:按硬件每秒、按张图/每秒视频、按 token。国内用户先看三条:① 只收信用卡,没有支付宝和微信;② 买的额度 1 年后过期(页面上明写着);③ API 生成的文件 1 小时后自动删除,不下载就没了。适合要出图出视频、要用字节 Seedream 和阿里视频模型的官方版本、且手上有境外卡的人;只想便宜地跑文本模型的,这里没有折扣。

更新于 2026-08-02 | ✅ 推荐级:厂商第一方入驻、官方价透明、失败不计费、逐月 Invoice 可下;扣分项为只收信用卡、额度 1 年过期、输出文件 1 小时删除、私有模型连闲置时间一起计费


先分清一件事:它不是中转站,也不主要用来跑 Claude Code

本站评的绝大多数站是「中转站」——转卖别人的 API,靠折扣吸引你。Replicate 是另一个物种:模型厂商自己上架的托管平台。

本站 2026-08-02 在它的 Explore 页抄下了这些带 Official 标记的模型和公开运行次数:

模型归属命名空间累计运行次数
openai/gpt-image-2OpenAI 官方1790 万
google/nano-banana-2Google 官方1580 万
black-forest-labs/flux-2-maxBlack Forest Labs 官方380 万
bytedance/seedream-5-lite字节跳动官方320 万
xai/grok-imagine-videoxAI 官方150 万
google/gemini-3.1-flash-ttsGoogle 官方38.4 万
anthropic/claude-opus-4.7Anthropic 官方22.7 万
alibaba/happyhorse-1.0阿里官方3.1 万
minimax/music-2.6MiniMax 官方2.5 万

这张表读出来是两句话:

第一,它是"官转"这个词的极限形态。 不是某个中间商说"我直连官方",而是 OpenAI 自己、Anthropic 自己、字节自己在这个平台上开号上架。你调 openai/gpt-image-2,就是在调 OpenAI 官方托管的那一份。这也是本站把它放进「官转站」栏目的原因。

第二,也是更重要的一条:跑量集中在图像和视频上,文本模型冷清得多。 gpt-image-2 一千七百多万次,claude-opus-4.7 二十二万次——差了近八十倍。这不是巧合:文本模型在 Replicate 上是官方价,而国内中转站能给到 1~3 折,谁也不会在这儿跑 Claude Code。

所以给本站读者的定位很清楚:

你要做的事该去哪
Claude Code / Codex 写代码、长文本对话中转站,例如 TeamoRouter云雾API
要渠道能溯源到具体供应商、要合规说得清OpenRouter
出图、出视频、出音乐、语音合成、跑开源模型Replicate

它和中转站不是竞争关系,是互补。 本站评过的十几家中转站里,能稳定提供图像视频模型的屈指可数,能提供字节 Seedream、阿里视频模型官方版本的一家都没有。

计费方式和中转站完全不同:三套并存

中转站的世界里只有一个概念——倍率乘官方价。Replicate 有三套计费方式同时存在,这是新手最容易懵的地方。

第一套:按硬件时间计费(大多数模型)。 官方说法是「Most models are billed by the time they take to run. The price-per-second varies according to the hardware in use.」——按它跑了多少秒 × 那块显卡每秒多少钱。你在模型页能看到成本估算。

第二套:按输出计费(图像、视频类)。 本站从定价页抄的实例:

模型计费方式
black-forest-labs/flux-1.1-pro$0.04 / 张
black-forest-labs/flux-dev$0.025 / 张
black-forest-labs/flux-schnell$3.00 / 一千张(合 $0.003 一张)
ideogram-ai/ideogram-v3-quality$0.09 / 张
recraft-ai/recraft-v3$0.04 / 张
wavespeedai/wan-2.1-i2v-480p$0.09 / 秒视频
wavespeedai/wan-2.1-i2v-720p$0.25 / 秒视频

⚠️ 视频那两行请认真看:720p 的图生视频是 每秒输出 $0.25——做一条 10 秒的视频就是 $2.5,约 18 元人民币。这是本站见过的所有 AI API 里单价最高的一类,做视频前一定要先算账。

第三套:按 token 计费(LLM 类)。 例如 anthropic/claude-3.7-sonnet 是 $3.00/百万输入 token、$0.015/千输出 token(合 $15/百万)——和 Anthropic 官方定价一模一样,一分不打折deepseek-ai/deepseek-r1 是 $3.75/百万输入、$0.01/千输出。

这对你意味着什么:不要拿中转站的「几折」去套 Replicate。它没有折扣这个概念,它卖的是「这些模型你在别处根本调不到官方版本」。想搞清中转站那套倍率折数是怎么回事,看 中转站倍率和汇率怎么算

硬件价格全表

如果你要跑的是按时间计费的模型,或者打算部署自己的私有模型,这张表就是你的成本底数。本站 2026-08-02 从定价页抄录:

硬件每秒每小时GPUGPU 显存内存
CPU (Small) cpu-small$0.000025$0.092GB
CPU cpu$0.000100$0.368GB
Nvidia L40S gpu-l40s$0.000975$3.511x48GB
Nvidia A100 80GB gpu-a100-large$0.001400$5.041x80GB144GB
Nvidia H100 gpu-h100$0.001525$5.491x80GB72GB
2x A100 gpu-a100-large-2x$0.002800$10.082x160GB288GB
2x H100 gpu-h100-2x$0.003050$10.982x
4x L40S gpu-l40s-4x$0.003900$14.044x
4x A100 gpu-a100-large-4x$0.005600$20.164x
4x H100 gpu-h100-4x$0.006100$21.964x
8x L40S gpu-l40s-8x$0.007800$28.088x
8x A100 gpu-a100-large-8x$0.011200$40.328x
8x H100 gpu-h100-8x$0.012200$43.928x

多卡档位后面都标着「Additional Multi-GPU capacity is available with committed spend contracts」——大规模多卡容量要签承诺消费合同

换算给你一个直觉:单张 H100 每小时 $5.49,约合 39 元人民币。一个模型跑 30 秒,成本约 $0.046。

本站实测:一次调用花多少钱、要等多久

这一节是本站第一次拿到逐次调用的一手账单数据(来自本站自己在用的账号,2026 年 7~8 月的真实记录):

模型排队实际运行总耗时计费
openai/gpt-image-216ms24.4s24.4s$0.01
openai/gpt-image-215ms18.5s18.5s$0.01
openai/gpt-image-220ms53.3s53.3s$0.01
google/gemini-3-pro17ms1m13.6s1m13.6s$0.06
meta/llama-guard-3-8b43ms109ms153ms低于 $0.01
meta/llama-guard-3-8b26.5s430ms26.9s低于 $0.01
meta/llama-guard-3-8b25s543ms25.6s低于 $0.01

三条结论,最后一条最重要:

① 出图不贵,但很慢。 gpt-image-2 每次约 $0.01(七分钱),但实际运行 18~53 秒。这不是网络问题,是模型本身的生成时间。做交互式产品要有心理准备,别指望像聊天一样秒回。

② 大模型跑长任务会明显贵。 gemini-3-pro 一次跑了 1 分 13 秒,扣 $0.06。

③ 排队最长等了 26.5 秒,但这段时间不收钱。 看最后两行:llama-guard-3-8b 真正运行只要 430 毫秒,却在队列里等了 26.5 秒——这就是所谓的「冷启动」(cold boot),模型实例不在线时要先加载。

好消息是它不计费。 官方文档写得很明确:公共模型「you only pay for the time it's active processing your requests. Setup and idle time for the model is free」——排队和启动时间免费,只按实际处理时间收钱

坏消息是体验很差:一个 0.4 秒的模型,你可能要等 27 秒才拿到结果。冷门模型尤其明显,热门模型(比如 gpt-image-2)几乎不排队(实测排队都在 20 毫秒以内)。这条规律很实用:选用得多的模型,比选便宜的模型更能省时间。

另外两条官方计费规则也值得记住:运行失败不收费(「if a run fails, we don't charge you」);但主动取消官方模型的运行,仍可能被收费

国内用户最关心的三件事:能不能充、要不要梯子、发票

能不能充值?——只收信用卡,没有支付宝

本站实测充值流程:账户 → Billing → Add credit,档位是 $10 / $20 / $50 / $100 / $1,000 / 自定义

支付方式走 Stripe,收款方实名为 Replicate, LLC(美国实体)。本站在支付方式管理页实测,可选项只有银行卡,未见支付宝或微信支付。

这就是国内用户的主要门槛:你需要一张能付美元的信用卡。这一点上它不如国内中转站方便,甚至不如 OpenRouter(后者官方明确支持支付宝)。

但有一条很值得对照着说:本站实测的这个账号账单地址就是 CN(中国),绑卡、扣款、逐月出账单全部正常,历史充值记录都是 Paid。这和 OpenRouter 形成鲜明反差——OpenRouter 在充值页会因为账单地址落在受限地区而直接封掉 OpenAI、Anthropic、Google 三家的模型,Replicate 目前没有这类地区限制openai/gpt-image-2anthropic/claude-opus-4.7 照常可用。

⚠️ 这是本站 2026-08-02 的实测状态,平台政策随时可能变,以你自己打开时看到的为准。

要不要梯子?

replicate.comapi.replicate.com 本站实测都解析在 Cloudflare104.18.x 段)。这意味着国内访问的可达性取决于当时的 Cloudflare 节点,通常能连上但不保证稳定,服务器部署建议自行测试。它的官网和文档全英文,没有中文界面。

发票怎么办?

账户页有完整的 **Invoices(逐月账单)**列表,每一笔都能点开下载,Stripe 侧也能拿到付款收据。但这些都是境外 Invoice,不是中国增值税发票——公司报销走不通国内流程。要开增值税专票的,看 灵眸AI 那一类国内站。

站点信息卡

站点名称
Replicate(replicate.com)
性质
模型托管与推理平台,非中转站;厂商以 Official 身份在自己命名空间下上架
运营主体
Replicate, LLC(Stripe 收款方实名,美国实体)
域名
1998-05-26 注册,已续至 2034-12-15(远长于行业惯例的 1 年)
解析
Cloudflare(replicate.com 与 api.replicate.com 同段)
模型规模
社区贡献的开源模型数以千计,另有大量厂商官方模型(OpenAI / Anthropic / Google / xAI / 字节 / 阿里 / MiniMax / Black Forest Labs 等)
计费方式
三套并存:按硬件秒 / 按张图或每秒视频 / 按 token
硬件单价
CPU $0.09/小时起;L40S $3.51、A100 80G $5.04、H100 $5.49;最高 8x H100 $43.92/小时
图像视频价
flux-dev $0.025/张、flux-1.1-pro $0.04/张、ideogram-v3-quality $0.09/张;wan-2.1 图生视频 480p $0.09/秒、720p $0.25/秒
文本模型价
官方价不打折(claude-3.7-sonnet $3/百万输入、$15/百万输出)
计费细则
公共模型 setup 与排队免费、只按 active 计费;私有模型 setup + idle + active 全程计费;失败不计费;取消官方模型的运行仍可能计费
起充
$10(另有 $20 / $50 / $100 / $1,000 / 自定义);到账最多需 5 分钟
支付方式
⚠️ 仅信用卡(Stripe),实测无支付宝与微信
额度有效期
⚠️ 页面明写 Credit expires after 1 year
免费额度
可免费试跑部分模型,用一阵后会要求设置账单
输出文件
⚠️ API 生成的文件 1 小时后自动删除,需自行保存
API 形态
异步任务制:POST 创建 prediction → 轮询查询;可加 Prefer: wait 头同步等待最多 60 秒
接入地址
https://api.replicate.com/v1/
发票
逐月 Invoice 可下载;无中国增值税发票
中文支持
无,全英文

三个最容易踩的坑

坑一:生成的文件 1 小时后就没了。

官方文档原话:「For predictions created through the API, output files are automatically deleted after an hour. You must save a copy of any files in the output if you'd like to continue using them.

你拿到的是一个临时下载链接,不是永久图床。 很多人第一次用是在脚本里存了个 URL,第二天发现全是 404。正确做法是拿到结果后立刻下载到自己的存储里,或者用 webhook 在完成时触发保存。

坑二:买的额度一年后过期。

充值页底部明写着 「Credit expires after 1 year.」 这不是"保留权利"的模糊表述,是写死的规则。所以不要一次性囤 $1,000,按你未来半年的用量买就够了。

坑三:私有模型要为闲置时间付钱。

这是公共模型和私有模型最大的区别,官方说明是:私有模型「you pay for all the time instances of the model are online: the time they spend setting up; the time they spend idle, waiting for requests; and the time they spend active」。

翻译过来:你部署了一个私有模型,它挂在那儿没人调用,也在按秒烧钱。 按 A100 每小时 $5.04 算,挂一天就是 $121。只有被标记为 fast booting fine-tunes 的那一类例外,它们只按活跃时间计费。

打算部署自己模型的人,这一条必须先看懂再动手。

该充多少

先用免费额度试,再充 $10。

  1. 注册后先白嫖。 官方说明是可以免费跑部分模型,用一阵之后才会要求设置账单。先拿这段额度把你要用的模型跑通、看清楚单价。
  2. 第一笔就充 $10(最低档)。按本站实测的量级换算:$10 大约够 1000 次 gpt-image-2 出图,或者 400 张 flux-dev,或者 40 秒 720p 视频。对个人试水足够了。
  3. 做视频的单独算账。 720p 图生视频 $0.25/秒,$10 只够 40 秒成片。如果你的目标是批量做视频,先按「单价 × 秒数 × 条数」算一遍再决定充多少,这是最容易超支的场景。
  4. 别囤额度——一年过期。

什么情况下别选它

  • 你只想便宜地跑 Claude Code 或长文本对话——别选。这里是官方价,没有折扣,中转站能给你 1~3 折。
  • 你没有能付美元的信用卡——别选,它不收支付宝和微信,这一条直接卡死。
  • 你要开中国增值税发票报销——别选,只有境外 Invoice。
  • 你要做的是秒级响应的交互产品——谨慎。冷门模型排队可能等二三十秒,本站实测最长 26.5 秒。
  • 你想把生成结果直接当图床用——别这么干,文件 1 小时后删除。
  • 你打算部署私有模型但用量很低——别急着上,闲置时间也计费,低频场景用公共模型更划算。

接入教程:和中转站最大的不同是「异步」

习惯了中转站那种 OpenAI 兼容接口的人,第一次用 Replicate 一定会卡在同一个地方:它默认不是"发一个请求等一个回复",而是一个任务系统。

基本形态

# 1. 创建任务,立刻返回,状态是 starting 或 processing
curl -s -X POST https://api.replicate.com/v1/predictions \
  -H "Authorization: Bearer $REPLICATE_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"version": "模型版本ID", "input": {"prompt": "a cat"}}'

# 2. 拿返回里的 id 去轮询,直到 status 变成 succeeded
curl -s https://api.replicate.com/v1/predictions/{prediction_id} \
  -H "Authorization: Bearer $REPLICATE_API_TOKEN"

状态一共这几种:startingprocessingsucceededfailedcanceled

不想轮询?加一个请求头

官方提供了同步模式,加上 Prefer: wait 即可:

curl -s -X POST https://api.replicate.com/v1/predictions \
  -H 'Prefer: wait' \
  -H "Authorization: Bearer $REPLICATE_API_TOKEN" \
  -H 'Content-Type: application/json' \
  -d '{"version": "模型版本ID", "input": {"prompt": "a cat"}}'

官方说明:Prefer: wait 会「Leave the request open and wait for the model to finish generating output」,还可以写成 wait=nn 是 1 到 60 之间的秒数,最多阻塞 60 秒。

⚠️ 但别把它当万能解:本站实测 gpt-image-2 单次运行就要 18~53 秒,gemini-3-pro 跑了 1 分 13 秒——超过 60 秒的任务,同步模式接不住,还是得轮询或者用 webhook。

三个实操建议

  1. 优先用 webhook 而不是轮询。控制台有独立的 Webhooks 页,任务完成时回调你,比循环查询省事也省请求数。
  2. 拿到输出立刻下载。见上文坑一,1 小时后文件就没了。
  3. 先在模型页上试跑一次再写代码。每个模型页都有网页版试运行和成本估算,比直接写代码调试快得多。

API Token 在「账户设置 → API tokens」里创建。

常见问题

Replicate 是中转站吗?和中转站有什么区别?

不是。 中转站转卖别人的 API 并靠折扣吸引用户;Replicate 是模型托管平台,OpenAI、Anthropic、Google、字节跳动、阿里、MiniMax 都在上面开了自己的命名空间、挂着带 Official 标记的模型,价格就是官方价、不打折。它的价值不在便宜,而在于你能调到那些中转站根本不提供的图像、视频、音乐和开源模型的官方版本

Replicate 怎么收费?为什么每次金额都不一样?

因为它有三套计费方式同时存在:多数模型按硬件运行秒数收费(例如 A100 每秒 $0.0014、H100 每秒 $0.001525);图像视频类按输出收费(flux-dev $0.025 一张、wan-2.1 720p 每秒视频 $0.25);LLM 类按 token 收费。所以同一笔钱在不同模型上差别极大。每个模型页都有成本估算,跑之前先看那里。

Replicate 有免费额度吗?

有一点,但很有限。 官方说明是可以免费运行部分模型,用一阵之后就会要求你设置账单。它没有 OpenRouter 那种「每天 50 次免费模型」的长期免费档位,免费额度更接近一次性试用。想长期低成本用,还是得充值。

国内能用 Replicate 吗?支持支付宝吗?

能用,但只收信用卡。 本站实测充值只能绑银行卡(走 Stripe,收款方为 Replicate, LLC),没有支付宝和微信支付。另外一条对中国用户是好消息:本站实测的账号账单地址就是 CN,绑卡付款和调用 OpenAI、Anthropic 的官方模型都正常——这一点和 OpenRouter 不同,后者会因为账单地址在受限地区而封掉这三家模型。域名解析在 Cloudflare,国内可达性不保证稳定,服务器部署前请自测。

生成的图片和视频能一直用吗?

不能,1 小时后自动删除。 官方文档明写:通过 API 创建的 prediction,输出文件一小时后会被自动删除,你必须自己保存副本。这是新手最常踩的坑——把返回的 URL 直接存进数据库当图床,第二天全部失效。正确做法是拿到结果后立刻下载到自己的存储,或用 webhook 在任务完成时触发保存。

排队等了半天,这段时间要收钱吗?

公共模型不收。 官方规则是公共模型只按**实际处理(active)**的时间计费,setup 和排队等待时间免费。本站实测过一次 llama-guard-3-8b:真正运行只用了 430 毫秒,却在队列里等了 26.5 秒,最终计费仍低于 $0.01。但私有模型是另一回事——私有模型连启动时间和闲置等待时间一起计费。另外,运行失败不收费,主动取消官方模型的运行则可能仍被收费。

充进去的额度会过期吗?

会,页面上明写「Credit expires after 1 year」——购买满一年后过期。 所以不建议一次性充很多,按未来半年的实际用量买就好。充值到账最多需要 5 分钟。