Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 每秒

FLUX 3 — 视频、图像与音频统一的多模态底座

FLUX 3 是 Black Forest Labs 的多模态基础模型,在同一套架构中联合训练图像、视频与音频。用于 AI 视频生成时,FLUX 3 单次最长 20 秒、画面与声音一同产出,并支持关键帧、参考片段与多语言对白。

模型特点
5–20 秒 · HD / FHD · 草稿→定稿工作流
适用场景
电影感镜头、视频风格转换
输入
文本、最多 10 张图或源视频
输出
视频(mp4)、可选音频
Input

必填 · 对白、环境音与画面内文字都可以写在同一条提示词里

5

整数,5 到 20 秒

默认 hd · 草稿预览仅支持 hd

默认 auto · 另有七种固定比例可选

默认开启 · 无声片段并不会更便宜

Estimated cost~$0.782782 credits
Result

Try one of these prompts

FLUX 3 API 是什么?

FLUX 3 是 Black Forest Labs 的多模态基础模型,目前可调用的是它的视频能力:reAPI 将其封装为一个异步接口,支持三种模式——文生视频、最多 10 张参考图的图生视频,以及基于已有片段的视频续写。单条片段 5 到 20 秒,输出 HD 或 FHD,可选 7 种固定宽高比外加 auto,音频默认生成,并提供 draft 模式用于在正式渲染前低成本预览。计费按秒,费率由模式、分辨率以及是否开启 draft 共同决定。

FLUX 3 生成样例:涵盖摄影、绘画、扁平插画与产品渲染

你能用这个模型做什么

可以用这个模型构建并上线的真实工作流与生产级用例。

FLUX 3 多输入控制:提示词、起始图、参考片段与关键帧共同驱动一次过渡

用提示词之外的方式指挥 FLUX 3

文字只是起点,不是全部指令。你可以给 FLUX 3 一张待动画化的首帧、几张锁定角色的参考图、一段希望把元素带入新场景的源片段,或者两个界定过渡起止的关键帧。FLUX 3 还能续写已有的视频及其音频,所以一个镜头可以被延长,而不必从头重新生成。

阅读 FLUX 3 文档
FLUX 3 将一家面包店门店场景本地化为英语、西班牙语、日语与法语

不用重拍就能把一支广告本地化

FLUX 3 支持多语言对白,并能在画面内渲染可读的文字,因此同一套创意方向可以在不同市场之间迁移。招牌、标题与动态排版是作为场景的一部分生成的,而不是事后合成上去的;配音也与画面一同产出——按照 Black Forest Labs 自己的早期评测,面部表情与多语言正是 FLUX 3 目前最强的部分。

FLUX 3 优化香水瓶产品视觉并将其延展为动态镜头

把产品从静态图带入动态镜头

同一套 FLUX 3 底座既能跨风格、跨比例、跨分辨率合成与编辑图像,也能把这些静态图延展成动态画面。产品图与视频之间,形状、颜色、材质与品牌标识保持可辨识——因为两者出自同一个模型,而不是把图像生成器和另一套视频生成器拼在一起。

价格

积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。

首次测试成本
$0.276276 credits

最低档一条 5 秒样片。

测试预算参考
充值积分
$10
约 36 次测试
$50
约 181 次测试
$100
约 362 次测试
模型类别价格
flux-3-video草稿预览 · hd
$0.056
56 credits · 1 second
续写草稿 · hd
$0.111
111 credits · 1 second
文本或关键帧 · hd
$0.157
157 credits · 1 second
文本或关键帧 · fhd
$0.267
267 credits · 1 second
视频续写 · hd
$0.378
378 credits · 1 second
视频续写 · fhd
$0.488
488 credits · 1 second

为什么选 reAPI

一个底座,而不是三套系统拼接

FLUX 3 在统一架构中从图像、视频与音频中学习,架构基于 Black Forest Labs 提出的 Self-Flow——一种让多模态生成与理解相互对齐的方法。各模态彼此约束:声音必须匹配撞击,运动必须服从质量。

声音与画面同时生成

FLUX 3 的每一条视频输出都自带原生音频,来自同一次生成——对白、环境音与撞击声落在它们应该在的那一帧上,而不是事后再往无声画面上对时间轴。

在便宜档位上做迭代

大多数视频模型每一次尝试都是同一个价格,试错因此很贵。FLUX 3 把它拆开了:草稿预览按约三分之一的费率计费,定稿时再沿用同一份草稿自己的提示词、时长与输入,以完整质量重新生成——完整费率只为你真正要留下的那一条付一次。

FLUX 3 对比 Seedance 2.0

在 Black Forest Labs 自己的早期评测中,这两者是所有对比对象里最接近的一组——观众在 52% 的对比中更偏好 FLUX 3,基本等同于掷硬币。区别在于覆盖面:两者现在都能在 reAPI 上调用,但 Seedance 2.0 是视频模型,而 FLUX 3 是一个更宽的多模态底座,其图像与行动阶段仍在陆续推出。

能力
FLUX 3
reAPI 上的 Seedance 2.0
覆盖面
一个多模态底座,横跨图像、视频、音频与动作预测。
视频生成,音频可选。
单次生成时长
单次最长 20 秒且带音频。
每次请求 4 到 15 秒。
输入类型
提示词、起始帧、参考图片、参考片段、参考音频,以及界定受控过渡的关键帧。
提示词、图片、首/尾帧角色、参考视频与参考音频。
音频
每条视频输出都带原生音频,与画面一同生成。
音频生成是每次请求上的显式开关。
多镜头连贯性
把片段以 agentic 方式串联成时长数分钟的序列,由视觉参考维系。
返回最后一帧并喂给下一次请求,以延续同一镜头。
可用性
已在 reAPI 上线,按秒计费,费率随模式与分辨率而定,另有更便宜的草稿档用于迭代。
今天就能在 reAPI 上调用,按秒并按分辨率计费。

对比反映撰写时公开可查的行为。52% 这一偏好数据来自 Black Forest Labs 自己的初步评测,测试对象为 10 秒 720p、带音频的文生视频片段,且 BFL 明确说明该模型仍在开发中;样本量与方法论均未公布,这不是独立基准测试。

三步准备好接入 FLUX 3

  1. step 01

    创建 API key

    在 reAPI 注册并生成一个 key。一个 key、一个余额,平台上所有模型共用同一套请求形态。

    打开
  2. step 02

    阅读 FLUX 3 参考文档

    FLUX 3 页面只跟进 Black Forest Labs 已经正式公布的内容——能力、输入类型与推出阶段;端点、参数与费率一经确认就会同步到这里。

    打开
  3. step 03

    先用已上线的模型发版

    带原生音频的视频模型在 reAPI 上已经可以调用。先基于其中之一把集成做完,之后切到 FLUX 3 只是换一个 model id 加一次参数映射。

    打开
docs/api/flux-3

API 参考

复制即用的代码片段与完整参数表。

curl -X POST https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flux-3-video",
    "prompt": "A rain-soaked cafe terrace at dusk, a tram rolls past",
    "duration": 5
  }'

参数校验失败

提交时同步拒绝并指明出错字段。检查枚举值、范围与 URL 字段——不产生任何扣费。

认证或余额问题

401 表示 Bearer 密钥缺失或无效;402 表示预扣额超出余额。密钥与积分在控制台管理。

内容或素材被拒

参考素材与生成结果都会经过自动审核。被拒的任务返回明确错误并全额退款。

任务失败或超时

进入失败状态的任务不会扣费——预扣自动退还。保留任务 ID,随时可重试。

常见问题

关于此模型的常见疑问。

FLUX 3 是 Black Forest Labs 的多模态基础模型。它在同一套架构中联合学习图像、视频与音频,而不是把它们当作彼此独立的系统;BFL 将其定位为迈向「能在物理与数字环境中感知、预测并行动的模型」的一步。

start building

准备好上线了吗?

在 Playground 中试用,或直接获取 API Key 立即接入。