API中转站评测
← 返回官转中转站

fal.ai 怎么用?价格、免费额度、优惠码与 Replicate 对比

30 秒结论:推荐,尤其是做视频的。 fal 和 Replicate 是同一赛道的直接竞品,但它更专注——只做生成式媒体(图像、视频、音频、3D),完全不碰通用对话模型。三个实测出来的差别值得先知道:① GPU 更便宜也更新,H100 标价 $4.50/时(Replicate 是 $5.49/时),承诺用量下低至 $1.89/时,而且有 Replicate 没有的 B200/B300;② 视频模型阵容更全,Kling 3.0、Seedance 2.0、Veo 3.1、MiniMax H3、Wan 2.7、PixVerse V6 都在;③ 生成的文件默认保留至少 7 天而不是 1 小时(Replicate 是 1 小时强制删除),保留期还能用请求头自己调。但有两条别人基本没写的坑并发数是按「过去四周的充值额」滚动计算的——新账号只有 2 并发,充够 $10 才到 10、$1000 以上才到 40,上个月充的这个月不算数;以及生成文件的 URL 默认是公开的,任何人拿到链接都能看,直到过期。中国用户的现实门槛和 Replicate 一样:只收信用卡,没有支付宝。 适合做图、做视频、要用可灵和字节模型官方版本的人;想跑 Claude Code 或省钱买对话额度的,这里没有你要的东西。

更新于 2026-08-02 | ✅ 推荐级:GPU 时价低于同类、视频模型阵容最全、冷启动不计费、数据保留可按请求配置;扣分项为仅信用卡、额度 365 天过期、并发按四周滚动、生成文件 URL 默认公开


先回答那个最多人搜的问题:fal 和 Replicate 选哪个

「fal ai vs」是这个品牌最真实的搜索意图之一,而中文互联网基本没有一份认真的对比。本站两边都查过,把差别压成一张表(数据均为 2026-08-02 实测):

维度fal.aiReplicate
定位只做生成式媒体:图像、视频、音频、3D通用模型托管,什么都有(含 LLM)
模型规模官方文档称 1,000+ 优化过的模型社区开源模型数以千计 + 厂商官方模型
H100 时价$4.50/时(承诺用量低至 $1.89/时)$5.49/时
更高端 GPU有 B200 $6.25/时、B300 $8.50/时最高到 H100
视频模型Kling 3.0、Seedance 2.0、Veo 3.1、MiniMax H3、Wan 2.7、PixVerse V6、LTX 2.3、Grok Imagine 1.5有,但阵容明显更窄
通用对话模型没有有(claude、deepseek 等,官方价)
生成文件保留默认至少 7 天,可用请求头调整固定 1 小时,不可配置
文件 URL默认公开,可设 ACL 变私有临时 URL
请求日志保留JSON 默认存 30 天,可用 X-Fal-Store-IO: 0 关掉文档未提供同等粒度的开关
冷启动计费不计费不计费
调用方式5 种:直连、队列阻塞、队列异步、SSE 流式、WebSocket 实时异步任务 + Prefer: wait 同步(最多 60 秒)
并发新账号 2,按过去四周充值额升到最高 40无同等公开阶梯
额度有效期购买后 365 天购买后 1 年
支付方式仅信用卡仅信用卡

怎么选,三句话:

  • 做视频 → fal。 模型阵容不是一个量级,而且按秒计费的单价更有竞争力。
  • 要跑通用对话模型,或者只想找一个什么都能跑的地方 → Replicate。 fal 根本没有 LLM。
  • 要拿结果当图床用、或者需要文件多留几天 → fal。 Replicate 一小时就删,这是它最硬的限制。

共同点也要说清楚:两家都是美国平台、都只收信用卡、都是官方价没有折扣、都没有中国增值税发票。它们不是中转站的替代品,是中转站覆盖不到的那一块。

价格:GPU 按小时、模型按输出,两套并存

GPU 时价(自建部署用)

本站 2026-08-02 从定价页抄录,List Price 是标价,As low as 是承诺用量下的最低价:

GPU显存标价最低可至
B300288GB$8.50/时$4.49/时
B200180GB$6.25/时$3.49/时
H200141GB$4.50/时$2.10/时
H10080GB$4.50/时$1.89/时
RTX PRO 600096GB$2.99/时$1.10/时

对照 Replicate 的 H100 $5.49/时:fal 标价便宜约 18%,而且它还有 Replicate 完全没有的 B200 和 B300。页面注明「Competitive pricing for custom deployments — Contact support@fal.ai to get started」,「最低可至」那一列要谈,不是自动给的

模型 API 价(直接调现成模型)

视频模型(站方原话:按输出单位计费,按秒或按条):

模型单位价格$1 能出多少
Wan 2.5$0.0520 秒
Kling 2.5 Turbo Pro$0.0714 秒
Veo 3$0.42.5 秒
Ovi$0.25 条

⚠️ Veo 3 请单独算账:$0.4 一秒,做一条 8 秒的片子就是 $3.2(约 23 元)。而同样长度用 Wan 2.5 只要 $0.4。同一件事在不同模型上差 8 倍,这是做视频最该先算清楚的一笔。

图像模型(站方说明:按张或按百万像素计费,表中已归一到 1MP 便于比较):

模型单位价格$1 能出多少
Seedream V4$0.0333 张
Flux Kontext Pro$0.0425 张
Nanobanana$0.039825 张
Qwen百万像素$0.0250 MP

站方注明:以上按 1MP 计,更高分辨率按比例加价;部分模型会按 GPU 时间而不是按输出计费,取决于架构。

和 Replicate 横向比一下图像:Replicate 的 flux-dev $0.025/张、flux-1.1-pro $0.04/张——图像这块两家基本打平,差距主要在视频和 GPU 上。

免费额度和优惠码:有,但不是自动送的

「fal.ai free」「fal.ai free credits」「fal.ai coupon code」是这个品牌英文搜索里最集中的几个词。本站把官方 FAQ 的原文找出来了:

Purchased credits expire 365 days from the date of purchase. Free credits and coupons have variable expiration depending on the specific grant, ranging from 1 week to 1 year.

读出来是三件事:

  1. 免费额度和优惠码确实存在——控制台的 Credits 页有独立的 Coupon code 输入框和 Redeem 按钮(本站实测)。
  2. 但它们是「发放制」,不是注册自动送。 官方措辞是「depending on the specific grant」,也就是按具体的发放活动而定,来源通常是官方活动、合作方赠送或商务申请。
  3. 免费额度的有效期短得多1 周到 1 年不等,而买来的额度统一是 365 天。拿到优惠码要先去账单页看它什么时候过期,别当成永久余额。

控制台的 Credits 页会把每一笔额度单独列出到期日(本站实测该页确实逐笔显示 Original expiry),这一点比很多平台透明。

一条被忽略的隐性成本:并发按「过去四周充值额」滚动计算

这是本文最值得单独拎出来的一节,因为它既影响成本又几乎没人写。

fal 的并发限制页写得很直白:「Your limit is based on credits purchased in the last four weeks.」

过去四周充值额并发请求数
新账号(官方 FAQ 原文)2
$1010
$10020
$50030
$1,000+40

「过去四周」这五个字是关键。 它不是买断制——你上个月充了 $500 拿到 30 并发,这个月不再充值,并发就会掉回去。官方 FAQ 也确认了另一头:新账号起步只有 2 个并发,超出的请求会排队而不是报错。

这对什么人有实际影响?

  • 做批量任务的(比如一次要生成几百张图):并发 2 和并发 30 是完全不同的体验。你可能会发现"充了钱之后突然快了",原因就在这里。
  • 用量忽高忽低的:淡季不充值,旺季一上来发现并发掉到底了,得先充钱再跑。
  • 只是偶尔试试的:2 并发完全够用,不用管这条。

建议:如果你的项目对吞吐有要求,把充值节奏做成按月滚动而不是一次性充一大笔——同样的钱,分摊到每四周能稳定维持更高的并发档位。

数据保留:文件默认公开 7 天,可以自己改

这一节对做产品和在意合规的人很重要,fal 在这块的颗粒度明显好于 Replicate

官方文档给的完整规则表:

数据类型默认保留怎么控制
生成的媒体(CDN 文件)可配置,FAQ 称默认至少 7 天X-Fal-Object-Lifecycle-Preference 请求头(同时控制访问权限)
请求负载(输入输出 JSON)30 天X-Fal-Store-IO: 0 请求头关闭,或通过 API 删除
持久化存储(/data 卷)永久只能手动删(控制台或 CLI)

三条实操结论:

① 文件 URL 默认是公开的。 官方 FAQ 原文:「By default, yes. Media URLs returned by fal (https://v3b.fal.media/...) are publicly accessible — anyone with the URL can access the file until it expires.」

这是便利也是风险。 好处是拿到就能直接用、能撑 7 天;坏处是只要 URL 泄露,任何人都能看到你生成的内容。要做私有的,得给请求设 ACL(官方有 File ACLs 文档)。如果你在给客户做东西、或者内容涉及未公开素材,务必先把这条配好。

② 不想让 fal 存你的输入输出,有开关。 加一个 X-Fal-Store-IO: 0 请求头就行。代价是控制台的 Request History 里看不到记录了。这在企业合规场景下是很有用的一条,Replicate 那边没有同等粒度的公开开关。

③ 别把 /data 持久卷当临时空间。 它是永久保留、按存储收费的,只能手动删。

站点信息卡

站点名称
fal.ai(品牌名 fal)
定位
面向开发者的生成式媒体平台:图像、视频、音频、3D;不提供通用对话模型
运营时长
archive.org 最早可查存档 2021-01-26,此后逐年均有快照(.ai 域名 RDAP 查不到注册信息)
模型规模
官方文档称 1,000+ 优化模型
模型来源
页脚 Labs 列出 Black Forest Labs、Google、OpenAI、xAI、Alibaba、Kling、ByteDance、ElevenLabs 等
计费方式
两套:GPU 按小时(自建部署)/模型按输出(按张、按秒视频、按百万像素)
GPU 时价
H100 $4.50、H200 $4.50、B200 $6.25、B300 $8.50、RTX PRO 6000 $2.99(承诺用量下分别低至 $1.89 / $2.10 / $3.49 / $4.49 / $1.10)
视频单价
Wan 2.5 $0.05/秒、Kling 2.5 Turbo Pro $0.07/秒、Veo 3 $0.4/秒、Ovi $0.2/条
图像单价
Seedream V4 $0.03/张、Flux Kontext Pro $0.04/张、Nanobanana $0.0398/张、Qwen $0.02/百万像素(按 1MP 计)
充值档位
$25 / $50 / $100 / $200 / 自定义;控制台标注 $25 约合 312 张图或 8 条视频
额度有效期
⚠️ 购买额度自购买日起 365 天过期;免费额度与优惠码 1 周至 1 年不等
优惠码
有,Credits 页设有 Coupon code 输入框与 Redeem 按钮;但属发放制,非注册自动送
并发限制
⚠️ 新账号 2;按过去四周充值额升级:$10→10、$100→20、$500→30、$1000+→40
余额耗尽
低于锁定阈值会锁账号、API 请求被拒,充值后解锁(企业 invoice 计费不受此限)
失败计费
服务器错误(HTTP 500+)不收费;客户端错误(如 422 无效输入)若已消耗 GPU 时间仍可能收费
冷启动
Model API 不为冷启动计费,只按推理时间收
数据保留
生成文件默认至少 7 天且 URL 公开(可配 ACL 与生命周期);请求 JSON 默认存 30 天,可用 X-Fal-Store-IO: 0 关闭
商用授权
⚠️ 按模型区分,模型页标 Commercial use 才可商用,标 Research only 的不可
调用方式
run(直连)/subscribe(队列阻塞)/submit(队列异步,官方推荐)/stream(SSE)/realtime(WebSocket)
接入地址
队列 https://queue.fal.run/{模型ID};直连 https://fal.run;鉴权头为 Authorization: Key <你的KEY>
支付方式
⚠️ 仅信用卡,实测无支付宝与微信
发票
可下载 Invoice,企业可申请 invoice 计费;无中国增值税发票
中文支持
无,全英文

中国用户的三个现实问题

一、能不能充值?——只能刷卡。

本站实测控制台的支付方式页,只能绑定银行卡,没有支付宝也没有微信。这一点和 Replicate 完全一样,也是这两家平台对国内个人开发者最实际的门槛。相比之下 OpenRouter 官方明确支持支付宝,但它做的是文本模型,跟 fal 不是一回事。

二、要不要梯子?

fal.ai 的官网、控制台和文档全英文,没有中文界面。本站建议:做服务器部署前自己测一次连通性和延迟,别直接照搬到生产环境。

三、发票和商用授权。

发票方面,控制台能下载 Invoice,企业还能申请转成 invoice 计费(按月开票、不受余额锁定限制),但都是境外发票,没有中国增值税发票,公司报销走不通。

商用授权这条更要紧,而且几乎没人提:fal 上的模型授权是逐个不同的——官方 FAQ 原文说,大多数模型可商用并在模型页标有 Commercial use 徽章,标着 Research only 的仅限非商业用途你要拿生成结果去做产品或卖钱,必须先去模型页确认这个徽章,不能默认「付费了就能商用」。

该充多少

先充最低的 $25 档,把三件事跑一遍再决定。

控制台在每个档位旁边直接给了换算(本站实测):

充值站方标注的大致产出
$25约 312 张图(Nano Banana 2)或 8 条视频(Seedance 2)
$50约 625 张或 16 条
$100约 1,250 张或 33 条
$200约 2,500 张或 66 条

从这组数字能反推出一件事:视频比图贵得多。 按 $25 档换算,一张图约 $0.08,而一条 Seedance 2 视频约 $3。如果你的项目是做视频,$25 只够试十来条,先按这个量级做预算。

三个建议:

  1. 第一笔 $25 只用来验证:跑通调用、确认目标模型的实际单价、确认它的商用授权徽章。
  2. 要吞吐就按月分批充,别一次性充一大笔——并发是按过去四周的充值额算的,分摊着充能稳定维持档位。
  3. 别囤额度,365 天过期。

什么情况下别选它

  • 你想跑 Claude Code、Codex 或任何通用对话模型——别选,fal 根本没有 LLM。去看中转站,或者 OpenRouter
  • 你没有能付美元的信用卡——别选,没有支付宝和微信。
  • 你要开中国增值税发票——别选,只有境外 Invoice。
  • 你生成的内容不能被别人看到,又不打算配 ACL——别直接用默认设置,文件 URL 默认公开且能撑 7 天。
  • 你要拿生成结果商用,又懒得逐个查授权——谨慎,模型授权是逐个不同的,标 Research only 的不能商用。
  • 你的用量很小又需要高并发——别指望,新账号只有 2 并发,并发是拿充值额换的。

接入教程:fal 特有的三件事

一、鉴权头不是 Bearer,是 Key

这是从别的平台迁过来最容易踩的一个坑。官方文档里的写法是:

Authorization: Key <你的 FAL_KEY>

不是 Bearer Replicate 用 Bearer,OpenAI 系也用 Bearer,照抄过来会直接 401。

API Key 在「Settings → API Keys」里创建。

二、两个域名,对应两种调用路径

用途地址
走队列(官方推荐,可靠)https://queue.fal.run/{模型ID}
直连(最简单,不排队不重试)https://fal.run

队列模式的完整流程:

# 1. 提交任务
curl -X POST https://queue.fal.run/fal-ai/flux/dev \
  -H "Authorization: Key $FAL_KEY" \
  -H "Content-Type: application/json" \
  -d '{"prompt": "a cat"}'

# 2. 查状态
curl https://queue.fal.run/fal-ai/flux/dev/requests/{request_id}/status \
  -H "Authorization: Key $FAL_KEY"

# 3. 取结果
curl https://queue.fal.run/fal-ai/flux/dev/requests/{request_id}/response \
  -H "Authorization: Key $FAL_KEY"

还可以 .../requests/{request_id}/cancel 取消任务。

三、五种调用方式,别只会用一种

这是 fal 比 Replicate 丰富的地方,官方文档给的对照表:

方法怎么工作什么时候用
run()直接 HTTP 调用,不走队列、不重试、不轮询快速原型
subscribe()走队列,阻塞到出结果脚本里最省事
submit()走队列,立即返回官方推荐,生产用
stream()SSE 渐进输出要边生成边显示
realtime()WebSocket 长连接延迟最敏感的场景

模型 ID 的写法是 fal-ai/nano-banana-2fal-ai/flux/dev 这种带命名空间的形式。

四个实操提醒

  1. 不要在浏览器前端直接调。官方明确说不要暴露 API Key,要在自己的后端做一层代理。
  2. 想让文件多留几天或变私有,用 X-Fal-Object-Lifecycle-Preference 头,配合 File ACLs。
  3. 不想让 fal 存你的输入输出,加 X-Fal-Store-IO: 0(代价是控制台看不到请求历史)。
  4. 遇到 content_policy_violation:这是内容审核触发的 422 错误,不可重试,得改输入。

常见问题

fal.ai 是什么?和中转站有什么区别?

它是面向开发者的生成式媒体平台,专做图像、视频、音频和 3D 模型的推理,官方文档称有 1,000+ 优化过的模型,Google、OpenAI、xAI、阿里、字节、可灵、ElevenLabs 等的模型都在上面。它不是中转站:没有折扣、按官方价收费,而且完全不提供通用对话模型——你没法用它跑 Claude Code。它和中转站是互补关系,覆盖的是中转站普遍做不好的图像视频这一块。

fal.ai 和 Replicate 哪个好?

做视频选 fal,要通用模型选 Replicate。 fal 的 H100 标价 $4.50/时(Replicate $5.49/时),还有 Replicate 没有的 B200/B300;视频模型阵容也更全(Kling、Seedance、Veo、MiniMax、Wan、PixVerse)。另一个实际差别是生成文件的保留期:fal 默认至少 7 天且能用请求头调整,Replicate 是固定 1 小时后删除、不可配置。反过来,Replicate 什么都能跑、包括 LLM,fal 完全没有对话模型。两家都只收信用卡、都是官方价。

fal.ai 有免费额度吗?优惠码怎么用?

有,但不是注册自动送。 控制台的 Credits 页有 Coupon code 输入框和 Redeem 按钮,官方 FAQ 也确认存在 free credits 和 coupons,但措辞是「depending on the specific grant」——按具体发放活动而定,通常来自官方活动、合作方或商务申请。特别注意有效期:买来的额度统一 365 天,而免费额度和优惠码是 1 周到 1 年不等,拿到后要去账单页确认到期日。

fal.ai 的额度会过期吗?余额用完会怎样?

会过期:官方 FAQ 明写购买的额度自购买之日起 365 天过期,控制台会逐笔标出到期日。余额用完的后果比较硬:当余额低于账号的锁定阈值时,账号会被锁定、API 请求直接被拒,充值后才解锁(企业的 invoice 计费不受此限)。所以做生产项目建议开启自动充值,或者把余额告警阈值设起来。

为什么我的请求一直排队?并发怎么提高?

因为并发数是拿充值额换的,而且按「过去四周」滚动计算。 官方 FAQ 说新账号起步只有 2 个并发,超出的请求会排队;并发限制页给的阶梯是:过去四周充值 $10 → 10 并发、$100 → 20、$500 → 30、$1,000 以上 → 40。关键在「过去四周」——上个月充的这个月不算,不持续充值并发就会掉回去。如果吞吐重要,把充值按月分批,比一次性充一大笔更划算。

fal 生成的图片和视频,别人能看到吗?

默认能。 官方 FAQ 原文是:fal 返回的媒体 URL(https://v3b.fal.media/...默认公开可访问,任何拿到 URL 的人都能打开,直到文件过期。默认保留期至少 7 天。要做私有必须自己配:用 X-Fal-Object-Lifecycle-Preference 请求头控制生命周期,用 File ACLs 把文件限制为仅自己或指定用户可见。给客户做东西或涉及未公开素材时,这一步别省。

fal 上的模型可以商用吗?

要逐个看,不能一概而论。 官方 FAQ 说明每个模型有各自的许可:大多数模型可商用,并在模型页标有 Commercial use 徽章;标着 Research only 的仅限非商业用途。付费使用不等于取得商用授权,拿生成结果做产品前,先去对应模型页确认徽章

请求失败了要收钱吗?冷启动要收钱吗?

服务器错误不收,客户端错误可能收。 官方 FAQ:HTTP 500 及以上的服务端错误从不计费;但像 422 这类客户端错误(无效输入),如果 runner 已经花了 GPU 时间处理,仍可能被收费冷启动不收费——Model API 只按推理时间计费,这一点和 Replicate 相同。