fal.ai 怎么用?价格、免费额度、优惠码与 Replicate 对比
30 秒结论:推荐,尤其是做视频的。 fal 和 Replicate 是同一赛道的直接竞品,但它更专注——只做生成式媒体(图像、视频、音频、3D),完全不碰通用对话模型。三个实测出来的差别值得先知道:① GPU 更便宜也更新,H100 标价 $4.50/时(Replicate 是 $5.49/时),承诺用量下低至 $1.89/时,而且有 Replicate 没有的 B200/B300;② 视频模型阵容更全,Kling 3.0、Seedance 2.0、Veo 3.1、MiniMax H3、Wan 2.7、PixVerse V6 都在;③ 生成的文件默认保留至少 7 天而不是 1 小时(Replicate 是 1 小时强制删除),保留期还能用请求头自己调。但有两条别人基本没写的坑:并发数是按「过去四周的充值额」滚动计算的——新账号只有 2 并发,充够 $10 才到 10、$1000 以上才到 40,上个月充的这个月不算数;以及生成文件的 URL 默认是公开的,任何人拿到链接都能看,直到过期。中国用户的现实门槛和 Replicate 一样:只收信用卡,没有支付宝。 适合做图、做视频、要用可灵和字节模型官方版本的人;想跑 Claude Code 或省钱买对话额度的,这里没有你要的东西。
更新于 2026-08-02 | ✅ 推荐级:GPU 时价低于同类、视频模型阵容最全、冷启动不计费、数据保留可按请求配置;扣分项为仅信用卡、额度 365 天过期、并发按四周滚动、生成文件 URL 默认公开
先回答那个最多人搜的问题:fal 和 Replicate 选哪个
「fal ai vs」是这个品牌最真实的搜索意图之一,而中文互联网基本没有一份认真的对比。本站两边都查过,把差别压成一张表(数据均为 2026-08-02 实测):
| 维度 | fal.ai | Replicate |
|---|---|---|
| 定位 | 只做生成式媒体:图像、视频、音频、3D | 通用模型托管,什么都有(含 LLM) |
| 模型规模 | 官方文档称 1,000+ 优化过的模型 | 社区开源模型数以千计 + 厂商官方模型 |
| H100 时价 | $4.50/时(承诺用量低至 $1.89/时) | $5.49/时 |
| 更高端 GPU | 有 B200 $6.25/时、B300 $8.50/时 | 最高到 H100 |
| 视频模型 | Kling 3.0、Seedance 2.0、Veo 3.1、MiniMax H3、Wan 2.7、PixVerse V6、LTX 2.3、Grok Imagine 1.5 | 有,但阵容明显更窄 |
| 通用对话模型 | 没有 | 有(claude、deepseek 等,官方价) |
| 生成文件保留 | 默认至少 7 天,可用请求头调整 | 固定 1 小时,不可配置 |
| 文件 URL | 默认公开,可设 ACL 变私有 | 临时 URL |
| 请求日志保留 | JSON 默认存 30 天,可用 X-Fal-Store-IO: 0 关掉 | 文档未提供同等粒度的开关 |
| 冷启动计费 | 不计费 | 不计费 |
| 调用方式 | 5 种:直连、队列阻塞、队列异步、SSE 流式、WebSocket 实时 | 异步任务 + Prefer: wait 同步(最多 60 秒) |
| 并发 | 新账号 2,按过去四周充值额升到最高 40 | 无同等公开阶梯 |
| 额度有效期 | 购买后 365 天 | 购买后 1 年 |
| 支付方式 | 仅信用卡 | 仅信用卡 |
怎么选,三句话:
- 做视频 → fal。 模型阵容不是一个量级,而且按秒计费的单价更有竞争力。
- 要跑通用对话模型,或者只想找一个什么都能跑的地方 → Replicate。 fal 根本没有 LLM。
- 要拿结果当图床用、或者需要文件多留几天 → fal。 Replicate 一小时就删,这是它最硬的限制。
共同点也要说清楚:两家都是美国平台、都只收信用卡、都是官方价没有折扣、都没有中国增值税发票。它们不是中转站的替代品,是中转站覆盖不到的那一块。
价格:GPU 按小时、模型按输出,两套并存
GPU 时价(自建部署用)
本站 2026-08-02 从定价页抄录,List Price 是标价,As low as 是承诺用量下的最低价:
| GPU | 显存 | 标价 | 最低可至 |
|---|---|---|---|
| B300 | 288GB | $8.50/时 | $4.49/时 |
| B200 | 180GB | $6.25/时 | $3.49/时 |
| H200 | 141GB | $4.50/时 | $2.10/时 |
| H100 | 80GB | $4.50/时 | $1.89/时 |
| RTX PRO 6000 | 96GB | $2.99/时 | $1.10/时 |
对照 Replicate 的 H100 $5.49/时:fal 标价便宜约 18%,而且它还有 Replicate 完全没有的 B200 和 B300。页面注明「Competitive pricing for custom deployments — Contact support@fal.ai to get started」,「最低可至」那一列要谈,不是自动给的。
模型 API 价(直接调现成模型)
视频模型(站方原话:按输出单位计费,按秒或按条):
| 模型 | 单位 | 价格 | $1 能出多少 |
|---|---|---|---|
| Wan 2.5 | 秒 | $0.05 | 20 秒 |
| Kling 2.5 Turbo Pro | 秒 | $0.07 | 14 秒 |
| Veo 3 | 秒 | $0.4 | 2.5 秒 |
| Ovi | 条 | $0.2 | 5 条 |
⚠️ Veo 3 请单独算账:$0.4 一秒,做一条 8 秒的片子就是 $3.2(约 23 元)。而同样长度用 Wan 2.5 只要 $0.4。同一件事在不同模型上差 8 倍,这是做视频最该先算清楚的一笔。
图像模型(站方说明:按张或按百万像素计费,表中已归一到 1MP 便于比较):
| 模型 | 单位 | 价格 | $1 能出多少 |
|---|---|---|---|
| Seedream V4 | 张 | $0.03 | 33 张 |
| Flux Kontext Pro | 张 | $0.04 | 25 张 |
| Nanobanana | 张 | $0.0398 | 25 张 |
| Qwen | 百万像素 | $0.02 | 50 MP |
站方注明:以上按 1MP 计,更高分辨率按比例加价;部分模型会按 GPU 时间而不是按输出计费,取决于架构。
和 Replicate 横向比一下图像:Replicate 的 flux-dev $0.025/张、flux-1.1-pro $0.04/张——图像这块两家基本打平,差距主要在视频和 GPU 上。
免费额度和优惠码:有,但不是自动送的
「fal.ai free」「fal.ai free credits」「fal.ai coupon code」是这个品牌英文搜索里最集中的几个词。本站把官方 FAQ 的原文找出来了:
Purchased credits expire 365 days from the date of purchase. Free credits and coupons have variable expiration depending on the specific grant, ranging from 1 week to 1 year.
读出来是三件事:
- 免费额度和优惠码确实存在——控制台的 Credits 页有独立的 Coupon code 输入框和 Redeem 按钮(本站实测)。
- 但它们是「发放制」,不是注册自动送。 官方措辞是「depending on the specific grant」,也就是按具体的发放活动而定,来源通常是官方活动、合作方赠送或商务申请。
- 免费额度的有效期短得多:1 周到 1 年不等,而买来的额度统一是 365 天。拿到优惠码要先去账单页看它什么时候过期,别当成永久余额。
控制台的 Credits 页会把每一笔额度单独列出到期日(本站实测该页确实逐笔显示 Original expiry),这一点比很多平台透明。
一条被忽略的隐性成本:并发按「过去四周充值额」滚动计算
这是本文最值得单独拎出来的一节,因为它既影响成本又几乎没人写。
fal 的并发限制页写得很直白:「Your limit is based on credits purchased in the last four weeks.」
| 过去四周充值额 | 并发请求数 |
|---|---|
| 新账号(官方 FAQ 原文) | 2 |
| $10 | 10 |
| $100 | 20 |
| $500 | 30 |
| $1,000+ | 40 |
「过去四周」这五个字是关键。 它不是买断制——你上个月充了 $500 拿到 30 并发,这个月不再充值,并发就会掉回去。官方 FAQ 也确认了另一头:新账号起步只有 2 个并发,超出的请求会排队而不是报错。
这对什么人有实际影响?
- 做批量任务的(比如一次要生成几百张图):并发 2 和并发 30 是完全不同的体验。你可能会发现"充了钱之后突然快了",原因就在这里。
- 用量忽高忽低的:淡季不充值,旺季一上来发现并发掉到底了,得先充钱再跑。
- 只是偶尔试试的:2 并发完全够用,不用管这条。
建议:如果你的项目对吞吐有要求,把充值节奏做成按月滚动而不是一次性充一大笔——同样的钱,分摊到每四周能稳定维持更高的并发档位。
数据保留:文件默认公开 7 天,可以自己改
这一节对做产品和在意合规的人很重要,fal 在这块的颗粒度明显好于 Replicate。
官方文档给的完整规则表:
| 数据类型 | 默认保留 | 怎么控制 |
|---|---|---|
| 生成的媒体(CDN 文件) | 可配置,FAQ 称默认至少 7 天 | X-Fal-Object-Lifecycle-Preference 请求头(同时控制访问权限) |
| 请求负载(输入输出 JSON) | 30 天 | X-Fal-Store-IO: 0 请求头关闭,或通过 API 删除 |
持久化存储(/data 卷) | 永久 | 只能手动删(控制台或 CLI) |
三条实操结论:
① 文件 URL 默认是公开的。 官方 FAQ 原文:「By default, yes. Media URLs returned by fal (https://v3b.fal.media/...) are publicly accessible — anyone with the URL can access the file until it expires.」
这是便利也是风险。 好处是拿到就能直接用、能撑 7 天;坏处是只要 URL 泄露,任何人都能看到你生成的内容。要做私有的,得给请求设 ACL(官方有 File ACLs 文档)。如果你在给客户做东西、或者内容涉及未公开素材,务必先把这条配好。
② 不想让 fal 存你的输入输出,有开关。 加一个 X-Fal-Store-IO: 0 请求头就行。代价是控制台的 Request History 里看不到记录了。这在企业合规场景下是很有用的一条,Replicate 那边没有同等粒度的公开开关。
③ 别把 /data 持久卷当临时空间。 它是永久保留、按存储收费的,只能手动删。
站点信息卡
- 站点名称
- fal.ai(品牌名 fal)
- 定位
- 面向开发者的生成式媒体平台:图像、视频、音频、3D;不提供通用对话模型
- 运营时长
- archive.org 最早可查存档 2021-01-26,此后逐年均有快照(.ai 域名 RDAP 查不到注册信息)
- 模型规模
- 官方文档称 1,000+ 优化模型
- 模型来源
- 页脚 Labs 列出 Black Forest Labs、Google、OpenAI、xAI、Alibaba、Kling、ByteDance、ElevenLabs 等
- 计费方式
- 两套:GPU 按小时(自建部署)/模型按输出(按张、按秒视频、按百万像素)
- GPU 时价
- H100 $4.50、H200 $4.50、B200 $6.25、B300 $8.50、RTX PRO 6000 $2.99(承诺用量下分别低至 $1.89 / $2.10 / $3.49 / $4.49 / $1.10)
- 视频单价
- Wan 2.5 $0.05/秒、Kling 2.5 Turbo Pro $0.07/秒、Veo 3 $0.4/秒、Ovi $0.2/条
- 图像单价
- Seedream V4 $0.03/张、Flux Kontext Pro $0.04/张、Nanobanana $0.0398/张、Qwen $0.02/百万像素(按 1MP 计)
- 充值档位
- $25 / $50 / $100 / $200 / 自定义;控制台标注 $25 约合 312 张图或 8 条视频
- 额度有效期
- ⚠️ 购买额度自购买日起 365 天过期;免费额度与优惠码 1 周至 1 年不等
- 优惠码
- 有,Credits 页设有 Coupon code 输入框与 Redeem 按钮;但属发放制,非注册自动送
- 并发限制
- ⚠️ 新账号 2;按过去四周充值额升级:$10→10、$100→20、$500→30、$1000+→40
- 余额耗尽
- 低于锁定阈值会锁账号、API 请求被拒,充值后解锁(企业 invoice 计费不受此限)
- 失败计费
- 服务器错误(HTTP 500+)不收费;客户端错误(如 422 无效输入)若已消耗 GPU 时间仍可能收费
- 冷启动
- Model API 不为冷启动计费,只按推理时间收
- 数据保留
- 生成文件默认至少 7 天且 URL 公开(可配 ACL 与生命周期);请求 JSON 默认存 30 天,可用 X-Fal-Store-IO: 0 关闭
- 商用授权
- ⚠️ 按模型区分,模型页标 Commercial use 才可商用,标 Research only 的不可
- 调用方式
- run(直连)/subscribe(队列阻塞)/submit(队列异步,官方推荐)/stream(SSE)/realtime(WebSocket)
- 接入地址
- 队列 https://queue.fal.run/{模型ID};直连 https://fal.run;鉴权头为 Authorization: Key <你的KEY>
- 支付方式
- ⚠️ 仅信用卡,实测无支付宝与微信
- 发票
- 可下载 Invoice,企业可申请 invoice 计费;无中国增值税发票
- 中文支持
- 无,全英文
中国用户的三个现实问题
一、能不能充值?——只能刷卡。
本站实测控制台的支付方式页,只能绑定银行卡,没有支付宝也没有微信。这一点和 Replicate 完全一样,也是这两家平台对国内个人开发者最实际的门槛。相比之下 OpenRouter 官方明确支持支付宝,但它做的是文本模型,跟 fal 不是一回事。
二、要不要梯子?
fal.ai 的官网、控制台和文档全英文,没有中文界面。本站建议:做服务器部署前自己测一次连通性和延迟,别直接照搬到生产环境。
三、发票和商用授权。
发票方面,控制台能下载 Invoice,企业还能申请转成 invoice 计费(按月开票、不受余额锁定限制),但都是境外发票,没有中国增值税发票,公司报销走不通。
商用授权这条更要紧,而且几乎没人提:fal 上的模型授权是逐个不同的——官方 FAQ 原文说,大多数模型可商用并在模型页标有 Commercial use 徽章,标着 Research only 的仅限非商业用途。你要拿生成结果去做产品或卖钱,必须先去模型页确认这个徽章,不能默认「付费了就能商用」。
该充多少
先充最低的 $25 档,把三件事跑一遍再决定。
控制台在每个档位旁边直接给了换算(本站实测):
| 充值 | 站方标注的大致产出 |
|---|---|
| $25 | 约 312 张图(Nano Banana 2)或 8 条视频(Seedance 2) |
| $50 | 约 625 张或 16 条 |
| $100 | 约 1,250 张或 33 条 |
| $200 | 约 2,500 张或 66 条 |
从这组数字能反推出一件事:视频比图贵得多。 按 $25 档换算,一张图约 $0.08,而一条 Seedance 2 视频约 $3。如果你的项目是做视频,$25 只够试十来条,先按这个量级做预算。
三个建议:
- 第一笔 $25 只用来验证:跑通调用、确认目标模型的实际单价、确认它的商用授权徽章。
- 要吞吐就按月分批充,别一次性充一大笔——并发是按过去四周的充值额算的,分摊着充能稳定维持档位。
- 别囤额度,365 天过期。
什么情况下别选它
- 你想跑 Claude Code、Codex 或任何通用对话模型——别选,fal 根本没有 LLM。去看中转站,或者 OpenRouter。
- 你没有能付美元的信用卡——别选,没有支付宝和微信。
- 你要开中国增值税发票——别选,只有境外 Invoice。
- 你生成的内容不能被别人看到,又不打算配 ACL——别直接用默认设置,文件 URL 默认公开且能撑 7 天。
- 你要拿生成结果商用,又懒得逐个查授权——谨慎,模型授权是逐个不同的,标
Research only的不能商用。 - 你的用量很小又需要高并发——别指望,新账号只有 2 并发,并发是拿充值额换的。
接入教程:fal 特有的三件事
一、鉴权头不是 Bearer,是 Key
这是从别的平台迁过来最容易踩的一个坑。官方文档里的写法是:
Authorization: Key <你的 FAL_KEY>
不是 Bearer。 Replicate 用 Bearer,OpenAI 系也用 Bearer,照抄过来会直接 401。
API Key 在「Settings → API Keys」里创建。
二、两个域名,对应两种调用路径
| 用途 | 地址 |
|---|---|
| 走队列(官方推荐,可靠) | https://queue.fal.run/{模型ID} |
| 直连(最简单,不排队不重试) | https://fal.run |
队列模式的完整流程:
# 1. 提交任务
curl -X POST https://queue.fal.run/fal-ai/flux/dev \
-H "Authorization: Key $FAL_KEY" \
-H "Content-Type: application/json" \
-d '{"prompt": "a cat"}'
# 2. 查状态
curl https://queue.fal.run/fal-ai/flux/dev/requests/{request_id}/status \
-H "Authorization: Key $FAL_KEY"
# 3. 取结果
curl https://queue.fal.run/fal-ai/flux/dev/requests/{request_id}/response \
-H "Authorization: Key $FAL_KEY"
还可以 .../requests/{request_id}/cancel 取消任务。
三、五种调用方式,别只会用一种
这是 fal 比 Replicate 丰富的地方,官方文档给的对照表:
| 方法 | 怎么工作 | 什么时候用 |
|---|---|---|
run() | 直接 HTTP 调用,不走队列、不重试、不轮询 | 快速原型 |
subscribe() | 走队列,阻塞到出结果 | 脚本里最省事 |
submit() | 走队列,立即返回 | 官方推荐,生产用 |
stream() | SSE 渐进输出 | 要边生成边显示 |
realtime() | WebSocket 长连接 | 延迟最敏感的场景 |
模型 ID 的写法是 fal-ai/nano-banana-2、fal-ai/flux/dev 这种带命名空间的形式。
四个实操提醒
- 不要在浏览器前端直接调。官方明确说不要暴露 API Key,要在自己的后端做一层代理。
- 想让文件多留几天或变私有,用
X-Fal-Object-Lifecycle-Preference头,配合 File ACLs。 - 不想让 fal 存你的输入输出,加
X-Fal-Store-IO: 0(代价是控制台看不到请求历史)。 - 遇到
content_policy_violation:这是内容审核触发的 422 错误,不可重试,得改输入。
常见问题
fal.ai 是什么?和中转站有什么区别?
它是面向开发者的生成式媒体平台,专做图像、视频、音频和 3D 模型的推理,官方文档称有 1,000+ 优化过的模型,Google、OpenAI、xAI、阿里、字节、可灵、ElevenLabs 等的模型都在上面。它不是中转站:没有折扣、按官方价收费,而且完全不提供通用对话模型——你没法用它跑 Claude Code。它和中转站是互补关系,覆盖的是中转站普遍做不好的图像视频这一块。
fal.ai 和 Replicate 哪个好?
做视频选 fal,要通用模型选 Replicate。 fal 的 H100 标价 $4.50/时(Replicate $5.49/时),还有 Replicate 没有的 B200/B300;视频模型阵容也更全(Kling、Seedance、Veo、MiniMax、Wan、PixVerse)。另一个实际差别是生成文件的保留期:fal 默认至少 7 天且能用请求头调整,Replicate 是固定 1 小时后删除、不可配置。反过来,Replicate 什么都能跑、包括 LLM,fal 完全没有对话模型。两家都只收信用卡、都是官方价。
fal.ai 有免费额度吗?优惠码怎么用?
有,但不是注册自动送。 控制台的 Credits 页有 Coupon code 输入框和 Redeem 按钮,官方 FAQ 也确认存在 free credits 和 coupons,但措辞是「depending on the specific grant」——按具体发放活动而定,通常来自官方活动、合作方或商务申请。特别注意有效期:买来的额度统一 365 天,而免费额度和优惠码是 1 周到 1 年不等,拿到后要去账单页确认到期日。
fal.ai 的额度会过期吗?余额用完会怎样?
会过期:官方 FAQ 明写购买的额度自购买之日起 365 天过期,控制台会逐笔标出到期日。余额用完的后果比较硬:当余额低于账号的锁定阈值时,账号会被锁定、API 请求直接被拒,充值后才解锁(企业的 invoice 计费不受此限)。所以做生产项目建议开启自动充值,或者把余额告警阈值设起来。
为什么我的请求一直排队?并发怎么提高?
因为并发数是拿充值额换的,而且按「过去四周」滚动计算。 官方 FAQ 说新账号起步只有 2 个并发,超出的请求会排队;并发限制页给的阶梯是:过去四周充值 $10 → 10 并发、$100 → 20、$500 → 30、$1,000 以上 → 40。关键在「过去四周」——上个月充的这个月不算,不持续充值并发就会掉回去。如果吞吐重要,把充值按月分批,比一次性充一大笔更划算。
fal 生成的图片和视频,别人能看到吗?
默认能。 官方 FAQ 原文是:fal 返回的媒体 URL(https://v3b.fal.media/...)默认公开可访问,任何拿到 URL 的人都能打开,直到文件过期。默认保留期至少 7 天。要做私有必须自己配:用 X-Fal-Object-Lifecycle-Preference 请求头控制生命周期,用 File ACLs 把文件限制为仅自己或指定用户可见。给客户做东西或涉及未公开素材时,这一步别省。
fal 上的模型可以商用吗?
要逐个看,不能一概而论。 官方 FAQ 说明每个模型有各自的许可:大多数模型可商用,并在模型页标有 Commercial use 徽章;标着 Research only 的仅限非商业用途。付费使用不等于取得商用授权,拿生成结果做产品前,先去对应模型页确认徽章。
请求失败了要收钱吗?冷启动要收钱吗?
服务器错误不收,客户端错误可能收。 官方 FAQ:HTTP 500 及以上的服务端错误从不计费;但像 422 这类客户端错误(无效输入),如果 runner 已经花了 GPU 时间处理,仍可能被收费。冷启动不收费——Model API 只按推理时间计费,这一点和 Replicate 相同。