Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 초당

FLUX 3 — 영상·이미지·오디오를 아우르는 멀티모달 모델

FLUX 3는 Black Forest Labs의 멀티모달 기반 모델로, 이미지와 영상, 오디오를 하나의 아키텍처에서 함께 학습합니다. AI 영상 생성에서는 한 번의 생성으로 최대 20초 분량의 화면과 소리를 동시에 만들어내며, 키프레임과 참조 클립, 다국어 대사까지 따릅니다.

모델 특징
5–20초 · HD / FHD · 초안 후 완성 워크플로우
적합한 용도
시네마틱 클립, 영상-대-영상 리스타일
입력
텍스트, 최대 10개 이미지 또는 소스 영상
출력
영상 (mp4), 선택적 오디오
Input

필수 · 대사와 환경음, 화면 속 텍스트를 하나의 프롬프트에 함께 적을 수 있습니다

5

정수, 5~20초

기본값 hd · 초안 미리보기는 hd만 지원합니다

기본값 auto · 고정 비율 7종 지원

기본값 켜짐 · 무음으로 만들어도 요금은 같습니다

Estimated cost~$0.782782 credits
Result

Try one of these prompts

FLUX 3 API란?

FLUX 3는 Black Forest Labs의 멀티모달 파운데이션 모델이며, 현재 호출할 수 있는 것은 비디오 기능입니다. reAPI는 이를 하나의 비동기 엔드포인트로 제공하며 텍스트-투-비디오, 참조 이미지 최대 10장을 쓰는 이미지-투-비디오, 기존 클립을 이어 가는 비디오-투-비디오 세 가지 모드를 지원합니다. 클립 길이는 5~20초, 출력은 HD 또는 FHD이고 고정 화면비 7종에 auto를 더한 옵션을 제공하며, 오디오는 기본으로 생성되고 본 렌더링 전에 저렴하게 확인할 수 있는 draft 모드도 있습니다. 과금은 초 단위이며 단가는 모드·해상도·draft 사용 여부로 결정됩니다.

FLUX 3 샘플 이미지 — 사진, 회화, 플랫 일러스트, 제품 렌더링

이 모델로 만들 수 있는 것

이 모델로 구축하고 배포할 수 있는 실제 워크플로우와 프로덕션 활용 사례입니다.

FLUX 3의 다중 입력 제어: 프롬프트, 시작 이미지, 참조 클립, 키프레임이 하나의 전환을 구동하는 모습

프롬프트만이 아닌 방식으로 FLUX 3를 지시하기

텍스트는 출발점일 뿐 지시의 전부가 아닙니다. FLUX 3에는 움직이게 할 첫 프레임, 캐릭터를 고정하는 참조 이미지, 요소를 새 장면으로 옮겨올 원본 클립, 또는 전환의 시작과 끝을 정의하는 두 개의 키프레임을 건넬 수 있습니다. 기존 영상과 그 오디오를 이어서 만들 수도 있어, 한 컷을 처음부터 다시 만들지 않고 늘릴 수 있습니다.

FLUX 3 문서 읽기
FLUX 3가 베이커리 매장 장면을 영어·스페인어·일본어·프랑스어로 현지화하는 모습

다시 촬영하지 않고 캠페인 현지화하기

FLUX 3는 다국어 대사를 처리하고 화면 안에 읽히는 텍스트를 렌더링하므로, 하나의 크리에이티브 방향을 여러 시장으로 옮길 수 있습니다. 간판과 타이틀, 애니메이션 타이포그래피는 나중에 합성하는 것이 아니라 장면의 일부로 생성되며, 음성 트랙도 화면과 함께 만들어집니다. Black Forest Labs의 자체 초기 평가에 따르면 표정 표현과 다국어 처리는 FLUX 3가 이미 특히 강한 영역입니다.

FLUX 3가 향수병 제품 비주얼을 다듬고 이를 움직임으로 확장하는 모습

제품을 정지 이미지에서 움직임으로

같은 FLUX 3 백본이 스타일과 화면비, 해상도를 넘나들며 이미지를 생성·편집하고, 그 정지 이미지를 움직임으로 확장합니다. 형태와 색, 재질, 브랜드 요소가 제품 컷과 영상 사이에서 알아볼 수 있게 유지되는데, 둘 다 하나의 모델에서 나오기 때문입니다. 이미지 생성기에 별도의 영상 생성기를 덧붙인 구조가 아닙니다.

가격

크레딧 기반 — 1 크레딧 = 0.001 USD. 성공한 생성에 대해서만 비용을 지불합니다.

첫 테스트 비용
$0.276276 credits

최저 등급 5초 샘플 1개.

테스트 예산 가이드
크레딧 충전
$10
약 36회 테스트
$50
약 181회 테스트
$100
약 362회 테스트
모델카테고리가격
flux-3-video초안 미리보기 — hd
$0.056
56 credits · 1 second
이어 만들기 초안 — hd
$0.111
111 credits · 1 second
텍스트·키프레임 — hd
$0.157
157 credits · 1 second
텍스트·키프레임 — fhd
$0.267
267 credits · 1 second
영상 이어 만들기 — hd
$0.378
378 credits · 1 second
영상 이어 만들기 — fhd
$0.488
488 credits · 1 second

reApi를 선택해야 하는 이유

세 시스템을 꿰맨 것이 아닌 하나의 기반

FLUX 3는 멀티모달 생성과 이해를 정렬하기 위한 Black Forest Labs의 접근법인 Self-Flow 위에서, 통합된 아키텍처 안에서 이미지와 영상, 오디오로부터 학습합니다. 각 모달리티는 서로를 제약합니다. 소리는 충격과 맞아야 하고, 움직임은 질량을 따라야 합니다.

소리는 화면과 함께 생성됩니다

FLUX 3의 모든 영상 출력에는 같은 생성에서 나온 네이티브 오디오가 함께합니다. 대사와 환경음, 충격음이 원래 있어야 할 프레임에 놓이며, 무음 영상에 나중에 타이밍을 맞출 필요가 없습니다.

저렴한 단계에서 반복해 보기

대부분의 영상 모델은 시도할 때마다 같은 요금을 받기 때문에 탐색 비용이 큽니다. FLUX 3는 이를 둘로 나눕니다. 초안 미리보기는 약 3분의 1 요금으로 돌아가고, 최종 렌더링은 그 초안의 프롬프트와 타이밍, 입력을 그대로 사용해 원본 품질로 다시 만듭니다. 실제로 남기는 결과 하나에만 정가를 지불하는 셈입니다.

FLUX 3 vs Seedance 2.0

Black Forest Labs의 자체 초기 평가에서 비교 대상 가운데 이 둘이 가장 가까웠습니다. 시청자가 FLUX 3를 선호한 비율은 52%로 사실상 동전 던지기입니다. 차이는 범위에 있습니다. 지금은 둘 다 reAPI에서 호출할 수 있지만, Seedance 2.0은 영상 모델이고 FLUX 3는 이미지와 액션 단계가 아직 공개되는 중인 더 넓은 멀티모달 기반 모델입니다.

기능
FLUX 3
reAPI의 Seedance 2.0
범위
이미지·영상·오디오·행동 예측을 아우르는 하나의 멀티모달 기반.
오디오를 선택할 수 있는 영상 생성.
1회 생성 길이
한 번에 오디오 포함 최대 20초.
요청당 4~15초.
입력 유형
프롬프트, 시작 프레임, 참조 이미지, 참조 클립, 참조 오디오, 제어된 전환을 위한 키프레임.
프롬프트, 이미지, 첫/마지막 프레임 역할, 참조 영상과 참조 오디오.
오디오
모든 영상 출력에 네이티브 오디오가 포함되며 화면과 함께 생성됩니다.
오디오 생성은 요청마다 명시적으로 켜는 옵션입니다.
멀티숏 연속성
클립을 에이전트 방식으로 연결해 몇 분 길이의 시퀀스를 만들고 시각 참조로 묶습니다.
마지막 프레임을 반환받아 다음 요청에 넣어 같은 컷을 이어갑니다.
이용 가능 여부
reAPI에서 사용 가능하며 모드와 해상도별 초 단위 과금. 반복 작업용 저렴한 초안 단계 제공.
오늘 reAPI에서 사용 가능하며 해상도별 초 단위 과금.

이 비교는 작성 시점에 공개된 동작을 기준으로 합니다. 52%라는 선호도 수치는 Black Forest Labs가 직접 수행한 예비 평가(10초 720p 텍스트-투-비디오, 오디오 포함)에서 나온 것이며, 해당 모델은 회사 스스로 아직 개발 중이라고 밝혔습니다. 표본 크기와 방법론은 공개되지 않았고 독립적인 벤치마크가 아닙니다.

세 단계로 FLUX 3 준비하기

  1. step 01

    API 키 만들기

    reAPI에 가입하고 키를 발급하세요. 키 하나, 잔액 하나로 플랫폼의 모든 모델에서 같은 요청 형식을 사용합니다.

    열기
  2. step 02

    FLUX 3 레퍼런스 읽기

    FLUX 3 페이지는 Black Forest Labs가 실제로 공개한 내용, 즉 기능과 입력 유형, 출시 단계만 따라갑니다. 엔드포인트와 파라미터, 요금은 확정되는 즉시 반영됩니다.

    열기
  3. step 03

    오늘 쓸 수 있는 모델로 출시하기

    네이티브 오디오를 지원하는 영상 모델은 reAPI에서 이미 호출할 수 있습니다. 지금 그중 하나로 연동을 만들어 두면, 나중에 FLUX 3로 옮기는 작업은 모델 ID와 파라미터 매핑뿐입니다.

    열기
docs/api/flux-3

API 레퍼런스

바로 사용 가능한 코드와 전체 파라미터 표입니다.

curl -X POST https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flux-3-video",
    "prompt": "A rain-soaked cafe terrace at dusk, a tram rolls past",
    "duration": 5
  }'

파라미터 검증 실패

제출 시 동기적으로 거부되며 문제 필드가 명시됩니다. 열거 값·범위·URL 필드를 확인하세요. 과금은 발생하지 않습니다.

인증 또는 잔액 문제

401은 Bearer 키 누락/무효, 402는 선차감액이 잔액을 초과함을 뜻합니다. 키와 크레딧은 콘솔에서 관리합니다.

콘텐츠 또는 소재 거부

참조 소재와 생성 결과는 자동 심사를 거칩니다. 거부된 작업은 명확한 오류와 함께 실패하고 전액 환불됩니다.

작업 실패 또는 시간 초과

실패 상태에 도달한 작업은 과금되지 않으며 선차감액이 자동 환불됩니다. 작업 ID를 보관했다가 재시도하세요.

자주 묻는 질문

이 모델에 대한 일반적인 질문입니다.

FLUX 3는 Black Forest Labs의 멀티모달 기반 모델입니다. 이미지와 영상, 오디오를 별개의 시스템으로 다루지 않고 하나의 아키텍처 안에서 함께 학습하며, BFL은 이를 물리적·디지털 환경에서 지각하고 예측하며 행동하는 모델로 가는 한 걸음으로 설명합니다.

start building

이제 출시할 준비가 되셨나요?

Playground에서 시험해 보거나 API 키를 발급받아 바로 연동해 보세요.