fal.ai 替代方案(2026):6 个视频 API 按每秒成本横评

按真实每秒成本盘 fal.ai 视频替代方案:同一 Seedance 2.0 在 1080p 只要 $0.34/s,fal 却要 $0.68/s,另含 Replicate 与自托管,一把密钥全搞定。

fal.ai 替代方案(2026):6 个视频 API 按每秒成本横评

摘要: fal.ai 胜在模型目录够广,但它按模型逐个计价,藏着两个坑:标称价往往买到的是低档位,而同一个模型的价格可能是统一费率供应商的两倍。同样是 1080p 的 Seedance 2.0,OpenAI 兼容网关(ofox.ai)收 $0.34/s(5 秒片段 $1.70),fal 带音频要 $0.682/s($3.41),差不多贵一倍。要自己跑开源权重模型,Replicate 的硬件计费更划算。要用 Runway、Veo 这类西方自研模型,直接找厂商才是绕开 fal 转售的正解。本文只用一个真正重要的数字给六个替代方案排序:同一模型、同一分辨率下的成本。

fal 替代方案怎么选?

按你实际生成什么来选,别看谁的目录最大。fal 赢在广度,一个账号就能碰到 Veo、Kling、Hailuo、Pika 和 Seedance。但广度不等于便宜,对于多数团队真正上量的那几个模型,存在更便宜也更可预测的路径。

场景选择原因
当代 Seedance / Wan 上量,账单要可预测Ofox(网关)按分辨率的每输出秒计费,一把密钥,同款 Seedance 2.0 约为 fal 一半的价
自部署的开源权重或自定义模型Replicate按硬件秒计费,完全掌控模型,公共模型跑失败不收费
你明确要 Runway 或 Veo,而非中国模型直连厂商跳过转售加价,直接找 Runway、Luma 或 Google 的 Gemini API
你要的就是 Hailuo,且想要源头MiniMax 直连官方国际平台,但套餐起充门槛偏高
视频加文本、图像模型共用一把密钥Ofox(网关)Seedance、Wan 和大模型都在同一个 OpenAI 兼容端点上
追求绝对最低成本、无单片费用,自己扛运维自托管 Wan开源权重跑自己的 GPU,零每秒加价

本文后面就是这张表背后的证据:人们为何离开 fal、每个替代方案怎么计费、同款模型的价格算账,以及切换用的代码。

开发者为什么找 fal 的替代方案

fal 把一大堆视频模型放进一套干净的 API,这件事它做得确实好。会去别处看的理由很窄、很具体,而且全都落在它怎么定价上。

离开的理由意味着什么替代方案在哪帮上忙
逐模型的计费单位有的按秒计费,有的按整段视频,Seedance 按百万 token统一按每输出秒计费的供应商让账单可预测
同一模型,价更高fal 上 1080p 的 Seedance 2.0 带音频约 $0.68/s网关同款模型只收 $0.34/s
标称价是上一代产品$0.05/s 的 Wan 2.5 是 480p 的上一代权重,不是当代 Wan 2.7 的折扣对齐模型版本,别只看单价
自研模型的转售加价Veo、Runway 等都是经 fal 转售直连厂商去掉中间层
只管视频的账号fal 是媒体 API,和你的大模型栈是分开的网关把视频和文本放到一把密钥上

这些都不说明 fal 有错。它们只是说明:对一个大量上量当代 Seedance 或 Wan、或者想要一份账单管所有的团队来说,fal 不该是默认选择。本文正是围绕这个场景展开的。

速览:6 个替代方案一览

下面凡是给出每秒单价的地方都对齐了分辨率,数据来自 2026 年 7 月各厂商的实时定价页。不带分辨率的单价没有可比性。

替代方案主计费单位当代视频最低价有中国模型吗?注册门槛
Ofox(OpenAI 兼容网关)输出秒,按分辨率分档Seedance 2.0 Mini $0.04/s(480p)Seedance、Wan、HappyHorse一把密钥,绑卡,按量付费
Replicate硬件秒,官方模型则按输出秒官方视频约 $0.09/s(480p)Kling、Wan、Seedance、Hailuo一把密钥,绑卡,按量付费
MiniMax / Hailuo(直连)每片段按预付视频点数Hailuo-02 512p/6s 约 $0.07/片原生(Hailuo 就是 MiniMax)国际平台,套餐起充高
Runway(直连)积分,按输出秒看当前 Gen-4 套餐无,西方自研模型开户,绑卡,套餐分档
Google Veo(经 Gemini API 直连)按输出秒看当前 Veo 档位无,西方自研模型Google Cloud / Gemini API 密钥
自托管 Wan(开源权重)你的 GPU 时间电费加一块 GPUWan 是开源权重(阿里)运维你自己扛

这张表能读出两点。第一,唯一拥有干净、低、当代每秒单价的替代方案,是网关和 Replicate 的官方模型。第二,直连厂商的路径(Runway、Veo、MiniMax)是用一层转售加价去换它自己的接入流程,只有当你需要的正是那个特定模型时才值得。

各替代方案怎么计费(以及 fal 在哪扎人)

「每秒」在这些平台上至少有四种不同含义,这正是随手一比就会被误导的根源。

Ofox 按输出秒计费,随分辨率分档。目录上标的价是模型的 480p 起价。Seedance 2.0 在 480p 是 $0.07/s,720p $0.16/s,1080p $0.34/s,4K $1.37/s,所以一段 5 秒的 1080p 片段就是 5 × $0.34 = $1.70Wan 2.7 在 720p 是 $0.10/s,1080p $0.15/s。没有硬件计费行,也没有闲置费。你向 POST /v1/videos 提交任务,轮询到状态变 completed,账单就是 duration × 该分辨率的单价。因为 Seedance、Wan 和你的文本模型都在同一把密钥后面,视频接入的是同一条代码路径、同一张账单。

fal 按模型逐个计费,单位并不统一。它的定价页写明按「输出单位计费,视模型而定按秒或按段」。有些是干净的按秒:Wan 2.5 是 $0.05/s(480p)、$0.10/s(720p)、$0.15/s(1080p),Veo 3 关音频 $0.50/s、开音频 $0.75/s,Veo 3.1 便宜些,$0.20/s 到 $0.40/s。另一些按整段视频。Seedance 按百万视频 token 计价,换算下来 720p 约 $0.3034/s,1080p 带音频约 $0.682/s,而更老的 Seedance 1 Pro 落在 $0.124/s 附近。不打开某个模型的页面,你没法假设它是按秒计费,也没法知道它是哪一代。

Replicate 有两条计费轨道,常让人踩坑。多数公共模型按硬件时间计费:你为 GPU 运行的秒数付钱,T4 是 $0.000225/s,H100 是 $0.001525/s。在 H100 上跑 90 秒的一次渲染,GPU 时间成本是 90 × $0.001525 = $0.137,但渲染时间是可变的,跑之前很难预测。另一条轨道上,Replicate 精选的官方模型和其他家一样按输出秒计费,480p 约 $0.09/s,720p 约 $0.25/s,它还列了一条更老的 Seedance lite 线,低至 $0.018/s。公共模型跑失败不收费;私有模型和部署则连启动、闲置时间也要计费。

MiniMax / Hailuo 直连按预付视频点数计费。一段 768p、6 秒的 Hailuo 2.3 片段是 1 点,1080p、6 秒是 2 点,便宜的 Hailuo-02 512p 档是 0.3 点。点数套餐大约每点 $0.224 到 $0.266,所以那段旗舰片段约 $0.22 到 $0.27。坑在于公示的套餐起充要几千美元,所以下单前先确认当下小额按量付费的条款。

一段 5 秒 1080p Seedance 2.0 片段的成本,Ofox 对比 fal同款模型、同分辨率:一段 5 秒 1080p 的 Seedance 2.0 片段对齐模型版本与分辨率,数据来自各厂商实时页面,2026 年 7 月Ofox $1.70$0.34/s × 5s,按输出秒fal $3.41$0.682/s,带音频在同一款 1080p 的 Seedance 2.0 上,Ofox 约为 fal 一半的价。在当代 Wan 2.7 上两者持平($0.10 到 $0.15/s)。

同一段片段在网关上固定 $1.70,在 fal 上带音频要 $3.41。这个差距不是折扣,而是同一个模型被标了两种价。

同款模型,不同账单:Seedance 与 Wan 跨平台对比

因为 Seedance 2.0 和 Wan 在 fal、Replicate 和网关上都有,它们是最公平的试金石。固定模型和分辨率,再看单价。

模型、分辨率OfoxfalReplicate
Seedance 2.0,480p$0.07/s按 token,更高官方按秒
Seedance 2.0,1080p$0.34/s约 $0.682/s(带音频)官方,见模型页
Seedance 2.0 Mini,480p$0.04/s(非同档位)更老的 lite 约 $0.018/s(上一代)
Wan 2.7(当代),720p$0.10/s$0.10/swan-2.1 720p $0.25/s
Wan 2.7(当代),1080p$0.15/s$0.15/s见模型页
Wan 2.5(上一代),480p(未上架)$0.05/s$0.09/s(wan-2.1 480p)

仔细读。在最新的 Seedance 上,网关约为 fal 一半的价。在当代 Wan 2.7 上两者完全一致,所以没理由为了同一个数字去承受逐模型计价的复杂。fal 只在更老的产品上显得便宜:$0.05/s 的 Wan 2.5 是标在 480p 的上一代,它自己的 1080p 档也是 $0.15/s,和当代 Wan 2.7 一样。Seedance 1 Pro 同样是上一代。Replicate 官方按秒的视频在当代模型上比这两家都高,而它唯一那个最低裸价,即约 $0.018/s 的老 Seedance lite 线,是去年的画质。

价格算账:真实的一个月 2,000 段片段

单价在你把它乘起来之前都是抽象的。假设一个小内容团队每月渲染 2,000 段片段,每段 5 秒、1080p,用 Seedance 2.0。那就是 10,000 输出秒。

供应商单价(Seedance 2.0,1080p)月账单对比网关
Ofox$0.34/s$3,400基准
fal(开音频)$0.682/s$6,820+$3,420(2.0 倍)
fal(关音频,按页估)看模型页不定查当前值
在 Ofox 上降到 Seedance 2.0 Mini(720p)$0.08/s$800草稿档路由

重点不是某个数字永远最低。重点是:在完全相同的模型和分辨率下,逐模型的加价大致把账单翻倍;而把草稿和大批量渲染切到更便宜的档位(720p 的 Mini),能在不离开这个端点的前提下把账单再砍掉好几倍。正是可预测的按秒计费,让这个路由决策变成一行改动,而不是第二次集成。

六个替代方案,逐个拆

1. Ofox,OpenAI 兼容网关

最适合大量上量当代 Seedance 或 Wan、且想要一份可预测账单的团队。一把密钥就能拿到 Seedance 2.0、它的 Mini 和 Fast 档,以及 Wan 2.7,按分辨率的每输出秒计费,和你的文本、图像模型在同一个端点上。它不托管 Kling、Veo 或 Sora,所以如果你的流水线就依赖这些特定自研模型,它不合适。对于它确实收录的模型,它是本次对比里最便宜的当代锚点。

2. Replicate

最适合你想自己部署、自己掌控的开源权重或自定义模型。它的硬件按秒轨道让你跑任何能容器化的模型,只为 GPU 渲染时间付费,对某个冷门开源权重模型,这能胜过所有托管的按秒方案,代价是运维得你自己做。它精选的官方模型和别家一样按输出秒计费。公共模型跑失败免费,这在你反复调 prompt 时很重要。取舍在于预测:硬件轨道上你付的是渲染时间而非输出秒,所以慢的模型账单更大。

3. MiniMax / Hailuo,直连

最适合你要的正是 Hailuo、且想从源头拿的情况。MiniMax 有一个国际平台 platform.minimax.io,和它的中国控制台是分开的,海外开发者可用邮箱或 OAuth 注册直连。计费是预付视频点数,约每点 $0.22 到 $0.27,一段 Hailuo 2.3 768p/6s 片段是 1 点。门槛在于公示的套餐起充要几千美元,所以它更适合有真实用量的团队,而不是只想测一次渲染的人。若你只想便宜地试试 Hailuo,它在 fal 和 Replicate 上也有转售。

4. Runway 与 Luma,直连

最适合你需要的是西方自研模型,比如 Runway 的 Gen-4 线或 Luma 的 Ray,而非中国模型。两家都跑自己的 API,按积分、按输出秒计费,也都在 fal 上被转售。这里替代 fal 的做法就是直连去掉转售层,只有当那个特定模型就是你的流水线、且你的用量大到会在意加价时才值得。价格请以各厂商当前的套餐页为准,因为积分兑美元的比率和套餐分档比统一的按秒表变得更频繁。

5. Google Veo,经 Gemini API 直连

最适合你要的模型是 Veo,且你宁可和 Google 直接维系关系而不是通过转售商。Veo 3 和 3.1 可经 Google 的 Gemini API 和 Vertex AI 使用,按输出秒计费,它们在 fal 上也有(Veo 3 是 $0.50 到 $0.75/s,Veo 3.1 便宜些,$0.20 到 $0.40/s)。直连意味着面对一个 Google Cloud 项目及其访问规则,而不是一个媒体聚合器,所以这个决策是关于你想要哪种计费关系和配额模型,而不是模型本身。

6. 自托管开源权重 Wan

最适合完全不想要单片费用、又有运维预算的团队。阿里的 Wan 系列是开源权重,你可以在自己的或租来的 GPU 上跑,只为算力付费。在高用量下,这是单片边际成本的下限,也是运维工作量的上限:服务栈、队列、重试都归你,GPU 账单不管在渲染还是闲置都归你。对多数团队,直到用量非常高之前,托管的按秒方案在总拥有成本上都更划算。

什么时候该留在 fal

fal 常常就是对的答案,这话得直说。如果你的流水线需要在一个账号下拥有最广的自研模型目录,Veo、Kling、Hailuo、Pika、Seedance 一网打尽而不用对接五个厂商,fal 生来就是干这个的。如果你被锁定在 Kling 上,网关不托管它,那 fal 或 Replicate 就是你的来源。而 Pika 干脆没有自研 API:它自己的文档把 API 用户指向 fal,所以 fal 实际上就是 Pika 的 API。广度和自研覆盖是留下的真实理由。单个高用量模型上的价格,则是离开的理由。

用 Ofox 试一遍最便宜的当代路径

如果你实际发布的模型是 Seedance 或 Wan,切换很小。同一个 OpenAI SDK,换一个 base_url,加上视频模型 ID。你提交一个任务,然后轮询到它变 completed

Python:在一个端点上提交 Seedance 任务

import os, time, requests

OFOX = "https://api.ofox.io/v1"
KEY = os.environ["OFOX_API_KEY"]
HEADERS = {"Authorization": f"Bearer {KEY}", "Content-Type": "application/json"}

def render(model: str, prompt: str, resolution: str = "1080p", seconds: int = 5) -> str:
    # 提交任务
    r = requests.post(f"{OFOX}/videos", headers=HEADERS, json={
        "model": model,                 # 在这里换档位,其余不变
        "prompt": prompt,
        "duration": seconds,
        "resolution": resolution,
    })
    job_id = r.json()["id"]

    # 轮询到终态(completed / failed / cancelled / expired)
    while True:
        s = requests.get(f"{OFOX}/videos/{job_id}", headers=HEADERS).json()
        if s["status"] in ("completed", "failed", "cancelled", "expired"):
            break
        time.sleep(2)
    if s["status"] != "completed":
        return s["status"]
    # 完成的任务返回 unsigned_urls(24 小时 TTL);若有 mirror_urls 则长期有效
    return (s.get("unsigned_urls") or s.get("mirror_urls") or [None])[0]

# 用 Mini 出草稿($0.04/s 起),用旗舰渲染最终版
draft = render("bytedance/seedance-2.0-mini", "a paper boat on a rain-slick street, neon reflections", "720p")
final = render("bytedance/seedance-2.0",      "a paper boat on a rain-slick street, neon reflections", "1080p")
print(draft, final)

Node:同样的写法

const OFOX = "https://api.ofox.io/v1";
const HEADERS = {
  Authorization: `Bearer ${process.env.OFOX_API_KEY}`,
  "Content-Type": "application/json",
};

async function render(model, prompt, resolution = "1080p", seconds = 5) {
  const r = await fetch(`${OFOX}/videos`, {
    method: "POST",
    headers: HEADERS,
    body: JSON.stringify({ model, prompt, duration: seconds, resolution }),
  });
  const { id } = await r.json();

  // 轮询到终态
  while (true) {
    const s = await (await fetch(`${OFOX}/videos/${id}`, { headers: HEADERS })).json();
    if (["completed", "failed", "cancelled", "expired"].includes(s.status)) {
      if (s.status !== "completed") return s.status;
      // 完成的任务返回 unsigned_urls(24 小时 TTL);若有 mirror_urls 则长期有效
      return (s.unsigned_urls || s.mirror_urls || [])[0] || s.status;
    }
    await new Promise((r) => setTimeout(r, 2000));
  }
}

// 一个字符串切换档位:bytedance/seedance-2.0-mini 对 bytedance/seedance-2.0
render("bytedance/seedance-2.0", "a paper boat on a rain-slick street, neon reflections").then(console.log);

值得记住的这个切换点:成本路由是一个字符串的改动(草稿用 bytedance/seedance-2.0-mini,成品用 bytedance/seedance-2.0),不是第二次集成,因为两个档位是同一个端点、同一个计费单位。

一条路径搞定选型

flowchart TD
    A[你发布的是哪个视频模型?] --> B{Seedance 还是 Wan?}
    B -->|是,且上量| C{想要一份可预测账单<br/>+ 大模型共用一把密钥?}
    C -->|是| D[Ofox 网关<br/>按输出秒]
    C -->|否,想自己跑| E[Replicate 硬件轨道<br/>或自托管 Wan]
    B -->|否,西方模型| F{Runway / Luma / Veo?}
    F -->|是,且上量| G[直连厂商<br/>跳过转售加价]
    F -->|只是测试| H[fal,目录最广]
    B -->|Kling / Pika / Sora| H

对多数发布当代 Seedance 或 Wan 的团队,决策收敛成一句话:网关上的按输出秒计费给你一个跑之前就能填进表格的数字,而且在同一款旗舰模型上约为 fal 一半的价。这种可预测性,比价格表里任何一行都更能构成切换的理由。

想要更深的价格算账和逐个模型的分析,可以看完整的 fal、Replicate、Ofox 三方视频价格深拆Seedance 2.0 Fast 与 Mini 档位对比Seedance 2.0 与 Wan 正面对决Sora、Veo、Kling 视频 API 横评Kling 2.6 Pro 视频 API 指南,以及 Veo 3.1 视频 API 教程

常见问题

下面的问题对应「fal 替代方案」和「视频 API 定价」在搜索里「大家还在问」中出现的内容。完整答案在页面的结构化数据里。

本次更新核对的来源

  • fal.ai 定价页:https://fal.ai/pricing
  • fal.ai Seedance 2.0 模型页:https://fal.ai/models/bytedance/seedance-2.0/text-to-video
  • fal.ai Veo 3 与 Veo 3.1 模型页:https://fal.ai/models/fal-ai/veo3, https://fal.ai/models/fal-ai/veo3.1
  • fal.ai Wan 2.5 模型页:https://fal.ai/models/fal-ai/wan-25-preview/text-to-video
  • fal.ai Wan 2.7 模型页:https://fal.ai/models/fal-ai/wan/v2.7/text-to-video
  • Pika 定价页:https://pika.art/pricing
  • fal.ai Pika 2.2 模型页:https://fal.ai/models/fal-ai/pika/v2.2/text-to-video
  • Replicate 定价页:https://replicate.com/pricing
  • Replicate 计费文档:https://replicate.com/docs/topics/billing
  • Replicate 文生视频合集:https://replicate.com/collections/text-to-video
  • MiniMax 国际站视频定价:https://platform.minimax.io/docs/guides/pricing-video
  • Pika API 页(确认 API 经由 fal.ai):https://pika.art/api
  • Ofox Seedance 2.0 模型页
  • Ofox Wan 2.7 模型页
  • Ofox 视频 API 文档:https://ofox.io/docs/api/videos
  • Ofox GET /v1/models(每秒视频起价,2026-07-26 核对)