Replicate 怎么用?replicate.com 价格、免费额度与国内充值
30 秒结论:推荐,但它多半不是你以为的那种东西。 Replicate 不是中转站——OpenAI、Anthropic、Google、字节跳动、阿里、MiniMax 都在它上面开了自己的命名空间,挂着带
Official标记的模型(openai/gpt-image-2、anthropic/claude-opus-4.7、bytedance/seedream-5-lite、alibaba/happyhorse-1.0),价格就是官方价,不打折。它真正的用途也不是跑 Claude Code:本站在它的模型页上抄下的运行次数说明了一切——图像模型gpt-image-2一千七百九十万次、nano-banana-2一千五百八十万次,而claude-opus-4.7只有二十二万次。换句话说:文本对话你该用中转站,出图、出视频、出音乐才是来这儿的理由。 计费方式也和中转站完全不同,三套并存:按硬件每秒、按张图/每秒视频、按 token。国内用户先看三条:① 只收信用卡,没有支付宝和微信;② 买的额度 1 年后过期(页面上明写着);③ API 生成的文件 1 小时后自动删除,不下载就没了。适合要出图出视频、要用字节 Seedream 和阿里视频模型的官方版本、且手上有境外卡的人;只想便宜地跑文本模型的,这里没有折扣。
更新于 2026-08-02 | ✅ 推荐级:厂商第一方入驻、官方价透明、失败不计费、逐月 Invoice 可下;扣分项为只收信用卡、额度 1 年过期、输出文件 1 小时删除、私有模型连闲置时间一起计费
先分清一件事:它不是中转站,也不主要用来跑 Claude Code
本站评的绝大多数站是「中转站」——转卖别人的 API,靠折扣吸引你。Replicate 是另一个物种:模型厂商自己上架的托管平台。
本站 2026-08-02 在它的 Explore 页抄下了这些带 Official 标记的模型和公开运行次数:
| 模型 | 归属命名空间 | 累计运行次数 |
|---|---|---|
openai/gpt-image-2 | OpenAI 官方 | 1790 万 |
google/nano-banana-2 | Google 官方 | 1580 万 |
black-forest-labs/flux-2-max | Black Forest Labs 官方 | 380 万 |
bytedance/seedream-5-lite | 字节跳动官方 | 320 万 |
xai/grok-imagine-video | xAI 官方 | 150 万 |
google/gemini-3.1-flash-tts | Google 官方 | 38.4 万 |
anthropic/claude-opus-4.7 | Anthropic 官方 | 22.7 万 |
alibaba/happyhorse-1.0 | 阿里官方 | 3.1 万 |
minimax/music-2.6 | MiniMax 官方 | 2.5 万 |
这张表读出来是两句话:
第一,它是"官转"这个词的极限形态。 不是某个中间商说"我直连官方",而是 OpenAI 自己、Anthropic 自己、字节自己在这个平台上开号上架。你调 openai/gpt-image-2,就是在调 OpenAI 官方托管的那一份。这也是本站把它放进「官转站」栏目的原因。
第二,也是更重要的一条:跑量集中在图像和视频上,文本模型冷清得多。 gpt-image-2 一千七百多万次,claude-opus-4.7 二十二万次——差了近八十倍。这不是巧合:文本模型在 Replicate 上是官方价,而国内中转站能给到 1~3 折,谁也不会在这儿跑 Claude Code。
所以给本站读者的定位很清楚:
| 你要做的事 | 该去哪 |
|---|---|
| Claude Code / Codex 写代码、长文本对话 | 中转站,例如 TeamoRouter、云雾API |
| 要渠道能溯源到具体供应商、要合规说得清 | OpenRouter |
| 出图、出视频、出音乐、语音合成、跑开源模型 | Replicate |
它和中转站不是竞争关系,是互补。 本站评过的十几家中转站里,能稳定提供图像视频模型的屈指可数,能提供字节 Seedream、阿里视频模型官方版本的一家都没有。
计费方式和中转站完全不同:三套并存
中转站的世界里只有一个概念——倍率乘官方价。Replicate 有三套计费方式同时存在,这是新手最容易懵的地方。
第一套:按硬件时间计费(大多数模型)。 官方说法是「Most models are billed by the time they take to run. The price-per-second varies according to the hardware in use.」——按它跑了多少秒 × 那块显卡每秒多少钱。你在模型页能看到成本估算。
第二套:按输出计费(图像、视频类)。 本站从定价页抄的实例:
| 模型 | 计费方式 |
|---|---|
black-forest-labs/flux-1.1-pro | $0.04 / 张 |
black-forest-labs/flux-dev | $0.025 / 张 |
black-forest-labs/flux-schnell | $3.00 / 一千张(合 $0.003 一张) |
ideogram-ai/ideogram-v3-quality | $0.09 / 张 |
recraft-ai/recraft-v3 | $0.04 / 张 |
wavespeedai/wan-2.1-i2v-480p | $0.09 / 秒视频 |
wavespeedai/wan-2.1-i2v-720p | $0.25 / 秒视频 |
⚠️ 视频那两行请认真看:720p 的图生视频是 每秒输出 $0.25——做一条 10 秒的视频就是 $2.5,约 18 元人民币。这是本站见过的所有 AI API 里单价最高的一类,做视频前一定要先算账。
第三套:按 token 计费(LLM 类)。 例如 anthropic/claude-3.7-sonnet 是 $3.00/百万输入 token、$0.015/千输出 token(合 $15/百万)——和 Anthropic 官方定价一模一样,一分不打折。deepseek-ai/deepseek-r1 是 $3.75/百万输入、$0.01/千输出。
这对你意味着什么:不要拿中转站的「几折」去套 Replicate。它没有折扣这个概念,它卖的是「这些模型你在别处根本调不到官方版本」。想搞清中转站那套倍率折数是怎么回事,看 中转站倍率和汇率怎么算。
硬件价格全表
如果你要跑的是按时间计费的模型,或者打算部署自己的私有模型,这张表就是你的成本底数。本站 2026-08-02 从定价页抄录:
| 硬件 | 每秒 | 每小时 | GPU | GPU 显存 | 内存 |
|---|---|---|---|---|---|
CPU (Small) cpu-small | $0.000025 | $0.09 | — | — | 2GB |
CPU cpu | $0.000100 | $0.36 | — | — | 8GB |
Nvidia L40S gpu-l40s | $0.000975 | $3.51 | 1x | 48GB | — |
Nvidia A100 80GB gpu-a100-large | $0.001400 | $5.04 | 1x | 80GB | 144GB |
Nvidia H100 gpu-h100 | $0.001525 | $5.49 | 1x | 80GB | 72GB |
2x A100 gpu-a100-large-2x | $0.002800 | $10.08 | 2x | 160GB | 288GB |
2x H100 gpu-h100-2x | $0.003050 | $10.98 | 2x | — | — |
4x L40S gpu-l40s-4x | $0.003900 | $14.04 | 4x | — | — |
4x A100 gpu-a100-large-4x | $0.005600 | $20.16 | 4x | — | — |
4x H100 gpu-h100-4x | $0.006100 | $21.96 | 4x | — | — |
8x L40S gpu-l40s-8x | $0.007800 | $28.08 | 8x | — | — |
8x A100 gpu-a100-large-8x | $0.011200 | $40.32 | 8x | — | — |
8x H100 gpu-h100-8x | $0.012200 | $43.92 | 8x | — | — |
多卡档位后面都标着「Additional Multi-GPU capacity is available with committed spend contracts」——大规模多卡容量要签承诺消费合同。
换算给你一个直觉:单张 H100 每小时 $5.49,约合 39 元人民币。一个模型跑 30 秒,成本约 $0.046。
本站实测:一次调用花多少钱、要等多久
这一节是本站第一次拿到逐次调用的一手账单数据(来自本站自己在用的账号,2026 年 7~8 月的真实记录):
| 模型 | 排队 | 实际运行 | 总耗时 | 计费 |
|---|---|---|---|---|
openai/gpt-image-2 | 16ms | 24.4s | 24.4s | $0.01 |
openai/gpt-image-2 | 15ms | 18.5s | 18.5s | $0.01 |
openai/gpt-image-2 | 20ms | 53.3s | 53.3s | $0.01 |
google/gemini-3-pro | 17ms | 1m13.6s | 1m13.6s | $0.06 |
meta/llama-guard-3-8b | 43ms | 109ms | 153ms | 低于 $0.01 |
meta/llama-guard-3-8b | 26.5s | 430ms | 26.9s | 低于 $0.01 |
meta/llama-guard-3-8b | 25s | 543ms | 25.6s | 低于 $0.01 |
三条结论,最后一条最重要:
① 出图不贵,但很慢。 gpt-image-2 每次约 $0.01(七分钱),但实际运行 18~53 秒。这不是网络问题,是模型本身的生成时间。做交互式产品要有心理准备,别指望像聊天一样秒回。
② 大模型跑长任务会明显贵。 gemini-3-pro 一次跑了 1 分 13 秒,扣 $0.06。
③ 排队最长等了 26.5 秒,但这段时间不收钱。 看最后两行:llama-guard-3-8b 真正运行只要 430 毫秒,却在队列里等了 26.5 秒——这就是所谓的「冷启动」(cold boot),模型实例不在线时要先加载。
好消息是它不计费。 官方文档写得很明确:公共模型「you only pay for the time it's active processing your requests. Setup and idle time for the model is free」——排队和启动时间免费,只按实际处理时间收钱。
坏消息是体验很差:一个 0.4 秒的模型,你可能要等 27 秒才拿到结果。冷门模型尤其明显,热门模型(比如 gpt-image-2)几乎不排队(实测排队都在 20 毫秒以内)。这条规律很实用:选用得多的模型,比选便宜的模型更能省时间。
另外两条官方计费规则也值得记住:运行失败不收费(「if a run fails, we don't charge you」);但主动取消官方模型的运行,仍可能被收费。
国内用户最关心的三件事:能不能充、要不要梯子、发票
能不能充值?——只收信用卡,没有支付宝
本站实测充值流程:账户 → Billing → Add credit,档位是 $10 / $20 / $50 / $100 / $1,000 / 自定义。
支付方式走 Stripe,收款方实名为 Replicate, LLC(美国实体)。本站在支付方式管理页实测,可选项只有银行卡,未见支付宝或微信支付。
这就是国内用户的主要门槛:你需要一张能付美元的信用卡。这一点上它不如国内中转站方便,甚至不如 OpenRouter(后者官方明确支持支付宝)。
但有一条很值得对照着说:本站实测的这个账号账单地址就是 CN(中国),绑卡、扣款、逐月出账单全部正常,历史充值记录都是 Paid。这和 OpenRouter 形成鲜明反差——OpenRouter 在充值页会因为账单地址落在受限地区而直接封掉 OpenAI、Anthropic、Google 三家的模型,Replicate 目前没有这类地区限制,openai/gpt-image-2、anthropic/claude-opus-4.7 照常可用。
⚠️ 这是本站 2026-08-02 的实测状态,平台政策随时可能变,以你自己打开时看到的为准。
要不要梯子?
replicate.com 和 api.replicate.com 本站实测都解析在 Cloudflare(104.18.x 段)。这意味着国内访问的可达性取决于当时的 Cloudflare 节点,通常能连上但不保证稳定,服务器部署建议自行测试。它的官网和文档全英文,没有中文界面。
发票怎么办?
账户页有完整的 **Invoices(逐月账单)**列表,每一笔都能点开下载,Stripe 侧也能拿到付款收据。但这些都是境外 Invoice,不是中国增值税发票——公司报销走不通国内流程。要开增值税专票的,看 灵眸AI 那一类国内站。
站点信息卡
- 站点名称
- Replicate(replicate.com)
- 性质
- 模型托管与推理平台,非中转站;厂商以 Official 身份在自己命名空间下上架
- 运营主体
- Replicate, LLC(Stripe 收款方实名,美国实体)
- 域名
- 1998-05-26 注册,已续至 2034-12-15(远长于行业惯例的 1 年)
- 解析
- Cloudflare(replicate.com 与 api.replicate.com 同段)
- 模型规模
- 社区贡献的开源模型数以千计,另有大量厂商官方模型(OpenAI / Anthropic / Google / xAI / 字节 / 阿里 / MiniMax / Black Forest Labs 等)
- 计费方式
- 三套并存:按硬件秒 / 按张图或每秒视频 / 按 token
- 硬件单价
- CPU $0.09/小时起;L40S $3.51、A100 80G $5.04、H100 $5.49;最高 8x H100 $43.92/小时
- 图像视频价
- flux-dev $0.025/张、flux-1.1-pro $0.04/张、ideogram-v3-quality $0.09/张;wan-2.1 图生视频 480p $0.09/秒、720p $0.25/秒
- 文本模型价
- 官方价不打折(claude-3.7-sonnet $3/百万输入、$15/百万输出)
- 计费细则
- 公共模型 setup 与排队免费、只按 active 计费;私有模型 setup + idle + active 全程计费;失败不计费;取消官方模型的运行仍可能计费
- 起充
- $10(另有 $20 / $50 / $100 / $1,000 / 自定义);到账最多需 5 分钟
- 支付方式
- ⚠️ 仅信用卡(Stripe),实测无支付宝与微信
- 额度有效期
- ⚠️ 页面明写 Credit expires after 1 year
- 免费额度
- 可免费试跑部分模型,用一阵后会要求设置账单
- 输出文件
- ⚠️ API 生成的文件 1 小时后自动删除,需自行保存
- API 形态
- 异步任务制:POST 创建 prediction → 轮询查询;可加 Prefer: wait 头同步等待最多 60 秒
- 接入地址
- https://api.replicate.com/v1/
- 发票
- 逐月 Invoice 可下载;无中国增值税发票
- 中文支持
- 无,全英文
三个最容易踩的坑
坑一:生成的文件 1 小时后就没了。
官方文档原话:「For predictions created through the API, output files are automatically deleted after an hour. You must save a copy of any files in the output if you'd like to continue using them.」
你拿到的是一个临时下载链接,不是永久图床。 很多人第一次用是在脚本里存了个 URL,第二天发现全是 404。正确做法是拿到结果后立刻下载到自己的存储里,或者用 webhook 在完成时触发保存。
坑二:买的额度一年后过期。
充值页底部明写着 「Credit expires after 1 year.」 这不是"保留权利"的模糊表述,是写死的规则。所以不要一次性囤 $1,000,按你未来半年的用量买就够了。
坑三:私有模型要为闲置时间付钱。
这是公共模型和私有模型最大的区别,官方说明是:私有模型「you pay for all the time instances of the model are online: the time they spend setting up; the time they spend idle, waiting for requests; and the time they spend active」。
翻译过来:你部署了一个私有模型,它挂在那儿没人调用,也在按秒烧钱。 按 A100 每小时 $5.04 算,挂一天就是 $121。只有被标记为 fast booting fine-tunes 的那一类例外,它们只按活跃时间计费。
打算部署自己模型的人,这一条必须先看懂再动手。
该充多少
先用免费额度试,再充 $10。
- 注册后先白嫖。 官方说明是可以免费跑部分模型,用一阵之后才会要求设置账单。先拿这段额度把你要用的模型跑通、看清楚单价。
- 第一笔就充 $10(最低档)。按本站实测的量级换算:$10 大约够 1000 次
gpt-image-2出图,或者 400 张 flux-dev,或者 40 秒 720p 视频。对个人试水足够了。 - 做视频的单独算账。 720p 图生视频 $0.25/秒,$10 只够 40 秒成片。如果你的目标是批量做视频,先按「单价 × 秒数 × 条数」算一遍再决定充多少,这是最容易超支的场景。
- 别囤额度——一年过期。
什么情况下别选它
- 你只想便宜地跑 Claude Code 或长文本对话——别选。这里是官方价,没有折扣,中转站能给你 1~3 折。
- 你没有能付美元的信用卡——别选,它不收支付宝和微信,这一条直接卡死。
- 你要开中国增值税发票报销——别选,只有境外 Invoice。
- 你要做的是秒级响应的交互产品——谨慎。冷门模型排队可能等二三十秒,本站实测最长 26.5 秒。
- 你想把生成结果直接当图床用——别这么干,文件 1 小时后删除。
- 你打算部署私有模型但用量很低——别急着上,闲置时间也计费,低频场景用公共模型更划算。
接入教程:和中转站最大的不同是「异步」
习惯了中转站那种 OpenAI 兼容接口的人,第一次用 Replicate 一定会卡在同一个地方:它默认不是"发一个请求等一个回复",而是一个任务系统。
基本形态
# 1. 创建任务,立刻返回,状态是 starting 或 processing
curl -s -X POST https://api.replicate.com/v1/predictions \
-H "Authorization: Bearer $REPLICATE_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{"version": "模型版本ID", "input": {"prompt": "a cat"}}'
# 2. 拿返回里的 id 去轮询,直到 status 变成 succeeded
curl -s https://api.replicate.com/v1/predictions/{prediction_id} \
-H "Authorization: Bearer $REPLICATE_API_TOKEN"
状态一共这几种:starting、processing、succeeded、failed、canceled。
不想轮询?加一个请求头
官方提供了同步模式,加上 Prefer: wait 即可:
curl -s -X POST https://api.replicate.com/v1/predictions \
-H 'Prefer: wait' \
-H "Authorization: Bearer $REPLICATE_API_TOKEN" \
-H 'Content-Type: application/json' \
-d '{"version": "模型版本ID", "input": {"prompt": "a cat"}}'
官方说明:Prefer: wait 会「Leave the request open and wait for the model to finish generating output」,还可以写成 wait=n,n 是 1 到 60 之间的秒数,最多阻塞 60 秒。
⚠️ 但别把它当万能解:本站实测 gpt-image-2 单次运行就要 18~53 秒,gemini-3-pro 跑了 1 分 13 秒——超过 60 秒的任务,同步模式接不住,还是得轮询或者用 webhook。
三个实操建议
- 优先用 webhook 而不是轮询。控制台有独立的 Webhooks 页,任务完成时回调你,比循环查询省事也省请求数。
- 拿到输出立刻下载。见上文坑一,1 小时后文件就没了。
- 先在模型页上试跑一次再写代码。每个模型页都有网页版试运行和成本估算,比直接写代码调试快得多。
API Token 在「账户设置 → API tokens」里创建。
常见问题
Replicate 是中转站吗?和中转站有什么区别?
不是。 中转站转卖别人的 API 并靠折扣吸引用户;Replicate 是模型托管平台,OpenAI、Anthropic、Google、字节跳动、阿里、MiniMax 都在上面开了自己的命名空间、挂着带 Official 标记的模型,价格就是官方价、不打折。它的价值不在便宜,而在于你能调到那些中转站根本不提供的图像、视频、音乐和开源模型的官方版本。
Replicate 怎么收费?为什么每次金额都不一样?
因为它有三套计费方式同时存在:多数模型按硬件运行秒数收费(例如 A100 每秒 $0.0014、H100 每秒 $0.001525);图像视频类按输出收费(flux-dev $0.025 一张、wan-2.1 720p 每秒视频 $0.25);LLM 类按 token 收费。所以同一笔钱在不同模型上差别极大。每个模型页都有成本估算,跑之前先看那里。
Replicate 有免费额度吗?
有一点,但很有限。 官方说明是可以免费运行部分模型,用一阵之后就会要求你设置账单。它没有 OpenRouter 那种「每天 50 次免费模型」的长期免费档位,免费额度更接近一次性试用。想长期低成本用,还是得充值。
国内能用 Replicate 吗?支持支付宝吗?
能用,但只收信用卡。 本站实测充值只能绑银行卡(走 Stripe,收款方为 Replicate, LLC),没有支付宝和微信支付。另外一条对中国用户是好消息:本站实测的账号账单地址就是 CN,绑卡付款和调用 OpenAI、Anthropic 的官方模型都正常——这一点和 OpenRouter 不同,后者会因为账单地址在受限地区而封掉这三家模型。域名解析在 Cloudflare,国内可达性不保证稳定,服务器部署前请自测。
生成的图片和视频能一直用吗?
不能,1 小时后自动删除。 官方文档明写:通过 API 创建的 prediction,输出文件一小时后会被自动删除,你必须自己保存副本。这是新手最常踩的坑——把返回的 URL 直接存进数据库当图床,第二天全部失效。正确做法是拿到结果后立刻下载到自己的存储,或用 webhook 在任务完成时触发保存。
排队等了半天,这段时间要收钱吗?
公共模型不收。 官方规则是公共模型只按**实际处理(active)**的时间计费,setup 和排队等待时间免费。本站实测过一次 llama-guard-3-8b:真正运行只用了 430 毫秒,却在队列里等了 26.5 秒,最终计费仍低于 $0.01。但私有模型是另一回事——私有模型连启动时间和闲置等待时间一起计费。另外,运行失败不收费,主动取消官方模型的运行则可能仍被收费。
充进去的额度会过期吗?
会,页面上明写「Credit expires after 1 year」——购买满一年后过期。 所以不建议一次性充很多,按未来半年的实际用量买就好。充值到账最多需要 5 分钟。