
FLUX 3 Image 編集ガイド:参照画像とバウンディングボックス
FLUX 3 Image の編集を参照画像の順序とボックスのプロンプトで指定。座標の順番、レイアウトと編集テーブルの違い、生成後の確認点を解説します。
FLUX 3 Image は最大10枚の参照画像を受け付けます。ただし、有用な編集はもっと小さな問いから始まります。画像のどの部分を変更するのでしょうか。Black Forest Labs は、指示による編集と、各要素に名前とボックスを与え、元の位置と移動先を分けるレイアウト形式の両方を文書化しています。[1][2]
このガイドでは、手法の選び方、プロンプト内へのボックスデータの書き方、結果の確認方法を説明します。以下は説明用のプロンプトテンプレートであり、実際の生成結果を報告したものではありません。現在のreAPIの制御項目と料金は FLUX 3 Image モデルページ、リクエストの仕様は APIドキュメントをご覧ください。
要点
- 1つの物体を明確に変更する場合は、参照画像1枚と具体的な指示から始めます。通常の画像編集で、手動のボックス指定は必須ではありません。[1]
- 参照順は重要です。
ref_image_0は最初の画像、ref_image_1は2番目の画像を指します。各画像に明確な役割を与えてください。[2] - キャプションと要素テーブルは、ともに
prompt内に記述します。バウンディングボックスは独立した最上位のリクエストパラメーターではありません。[2] - 座標は正規化した0〜1000のグリッドで
[top, left, bottom, right]の順に指定します。画像のピクセル座標ではありません。[2] - ボックスは配置の指示として扱います。BFLはクリッピングマスクではないと説明しており、変更していないピクセルも確認が必要です。[2]
FLUX 3 Image の編集は、具体的に言える変更から始める
画像1枚を編集する場合は、対象の物体と目標の結果が分かる指示を書きます。BFLの編集ガイドは、該当するものが1つだけになるほど正確に要素を指定することを勧めています。モデルは指示を展開し、多くの編集でボックスを推定できます。すべてのリクエストに完全な要素テーブルを用意する必要はありません。[1]
木のテーブルにクリーム色のマグカップが置かれた架空の商品写真を考えます。最初のプロンプトは次のように書けます。
Change the cream ceramic mug beside the closed notebook to a deep teal glaze.
Keep the mug's handle shape, the notebook, the wooden table, the camera angle,
and the soft light from the left unchanged.これで変更する対象が分かり、後で確認する部分も定まります。マグが2つあれば、どちらかを指定します。取っ手を見えるままにする必要があれば、それも伝えてください。「写真を良くして」という一般的な依頼では、こうした判断をモデルに委ねることになります。
FLUX 3 Image では、まず最小限の、明確に説明できる編集を試すことを勧めます。位置が曖昧な場合、似た物体が複数ある場合、構図そのものを変える場合に、明示的なボックスを追加します。これは編集方針であり、特定のプロンプト形式が常に成功するという主張ではありません。
参照画像ごとに役割を決める
FLUX 3 Image は最大10枚の参照画像に対応します。BFLは「Image 1」のような順番と、ref_image_0 から始まる識別子の2通りの参照方法を説明しています。編集リクエストで auto を使う場合、最初の参照画像が出力のアスペクト比も決めます。[1][2]
部屋のコンセプト画像なら、役割は次のように設定できます。
| 参照画像 | プロンプト内の役割 | 結果で確認すること |
|---|---|---|
Image 1 / ref_image_0 | 部屋とカメラの視点 | 窓の位置と部屋のフレーミング |
Image 2 / ref_image_1 | 窓の近くに置く椅子 | 椅子の形、布地、向き |
Image 3 / ref_image_2 | クッションの柄 | クッション上の柄の配置 |
説明用の指示は次のとおりです。「Image 1を部屋として使います。Image 2の椅子を窓の横に置いてください。Image 3の柄でクッションを1つ追加します。カメラの視点と部屋の既存の家具は変更しないでください。」
この参照順をタスクの記録と一緒に保存してください。プロンプトを変えずに入力順を入れ替えると、各役割を担う画像が変わります。また、要件に2枚しか必要ないのに10枠すべてを埋める意味はあまりありません。実際に役立つ枚数は、各画像の役割をどこまで明確に説明できるかで決まります。
reAPIの FLUX 3 Image リクエストでは、参照URLを image_urls に指定します。FLUX 3 Image APIリファレンスに、受け付けるURLとリクエストの制限があります。プロンプトの識別子は引き続き0から数えます。
レイアウトデータはプロンプト内に記述する
FLUX 3 Image はキャプションに続けて要素のJSON配列を使います。新しい構図では、各要素に id、bbox、desc を指定します。キャプション内で対応するidを山括弧で示し、同じプロンプト文字列にテーブルを追加します。[2]
マグを左、ノートを右に置く正方形のレイアウト例です。
A quiet overhead product photograph of a teal mug <mug_1> and a closed
cream notebook <notebook_1> on a pale wooden desk <desk_1>.
[
{"id":"desk_1","bbox":[0,0,1000,1000],"desc":"A pale wooden desk in soft daylight."},
{"id":"mug_1","bbox":[300,120,760,450],"desc":"One teal ceramic mug with its handle visible."},
{"id":"notebook_1","bbox":[230,540,820,900],"desc":"A closed cream notebook without lettering."}
]数値は相対的な位置を表します。[0,0,500,500] は画像の左上4分の1です。解像度を変えても、この値がピクセルになるわけではありません。アスペクト比を変えると座標グリッドも画面に合わせて伸びるため、レイアウトを設計したときと同じ比率を使ってください。[2]
コードでリクエストを作る場合は、配列をシリアライズしてキャプションに追加します。これにより、入れ子のJSON内の引用符をすべて手動でエスケープせずに済みます。プロンプトにボックスデータがあるからといって、別の bbox フィールドを送信しないでください。
編集では元のボックスと移動先のボックスを使う
編集には、新しいレイアウトより多くの情報が必要です。要素がどこから来て、最終的にどこに置かれるかを伝えます。FLUX 3 Image の編集形式では、そのために from、src_bbox、tgt_bbox を使います。[2]
| 意図する操作 | from | src_bbox | tgt_bbox |
|---|---|---|---|
| 要素を同じ位置に保つ | 参照画像id | 現在のボックス | 同じボックス |
| 要素の移動またはサイズ変更 | 参照画像id | 現在のボックス | 別のボックス |
| 追加、置換、色の変更 | null | null | 移動先のボックス |
| 要素を削除 | 参照画像id | 現在のボックス | null |
例えば、マグを移動する行は次のようになります。
{
"id": "mug_1",
"from": "ref_image_0",
"src_bbox": [300, 120, 760, 450],
"tgt_bbox": [300, 200, 760, 530],
"desc": "The teal ceramic mug with the same shape and visible handle."
}併記する指示では、マグを右へ動かし、ノートと机は変更しないと伝えます。残す必要のある要素には保持用の行を追加します。その行では元位置と移動先に同じ座標を使います。
色の変更について、BFLが文書化した形式は新しい行です。from: null、src_bbox: null と、目標の外観を説明する対象ボックスを使います。削除では元の参照画像とボックスを残し、対象ボックスを null にします。文章の指示でも削除を伝えてください。指示とテーブルは一致させます。[2]
これらの座標は上記の架空のレイアウト用です。流用する前に自分の画像を測ってください。JSONとして有効でも、別の物体を指している場合があります。
実際の要件に合わせて解像度とgroundingを選ぶ
FLUX 3 Image の解像度区分は 768sq、1k、1.5k、2k、4k の5段階で、既定値は 1k です。検索による情報補強(grounding)は既定で有効で、生成前のウェブ検索と画像検索を許可します。false にすると、その検索手順を無効にします。[3]
これらの項目は別々の問いに答えます。解像度は出力区分を選びます。Groundingは、モデルがプロンプトと指定入力の外から補助情報を探せるかを決めます。架空のスタジオ構図なら、無効にする方が意図した流れに合う場合があります。実在の被写体や現在の視覚的な参考を含む要件では、検索が役立つかを判断し、結果も確認してください。
BFLは FLUX 3 Image のネイティブ2K・4K生成を説明しています。ただし、大きな出力は、小さな編集で顔、ラベル、質感が保持された証拠にはなりません。納品サイズで重要な領域を確認してください。最終区分を選ぶ前に、古い料金をワークフローに転記するのではなく、現在の FLUX 3 Image 料金を確認します。[4]
変更していない部分も編集箇所と同じように確認する
BFLのボックス文書で特に重要な注意点は、ボックスが配置と大きさを誘導する一方、要素を厳密なマスクに切り取らないという点です。削除例では、編集ボックス外のピクセルは通常同一のままと説明しています。これは出力を比較する理由であり、変化がまったくないという普遍的な約束ではありません。[2]
マグの例では、取っ手、ノートの端、机の木目、影の境界を確認します。複数回の編集が必要なら、承認済みの元画像を保存し、各結果と比較してください。魅力的な新しい構図でも、元のノートを変えないという要件に失敗することがあります。
簡単な確認記録には、入力順、プロンプト、要素テーブル、アスペクト比、解像度、採用または不採用の短いメモを含められます。繰り返し編集では、前に採用した画像を残します。これは推奨する確認手順です。この記事は再試行率や編集精度を測定したとは主張しません。
FLUX 3 Image 編集のよくある質問
バウンディングボックスなしでも編集できますか?
はい。参照画像と文章の指示を送信します。BFLは直接編集を文書化し、多くの編集でモデルが要素のボックスを推定できると説明しています。明示的な配置指示が必要な場合は、自分でボックスを指定してください。[1]
参照画像は何枚使えますか?
最大10枚です。各画像が提供する内容を説明し、順序を保ちます。最初は ref_image_0 で、通常の表現では「Image 1」です。[1]
バウンディングボックスはピクセルで測りますか?
いいえ。0から1000の正規化整数を [top,left,bottom,right] の順に使います。出力解像度に関係なく、画面内の対応する割合の領域を覆います。[2]
画像から画像の編集は元のアスペクト比を保ちますか?
編集リクエストで aspect_ratio: "auto" を指定すると、最初の参照画像が比率を決めます。別の形状が必要なら明示的な比率を選び、レイアウトのボックスもその形状に合わせて設計してください。[1]
ボックス外のピクセルを完全に保持する保証はありますか?
その前提にはしないでください。BFLの技術ガイドは保持について限定し、ボックスはクリッピングマスクではないと説明しています。ピクセルを変えないことが受け入れ条件なら、該当箇所で返されたファイルと元画像を比較してください。[2]
FLUX 3 Image をダウンロードしてローカルで使えますか?
BFLは、自社のインフラで FLUX 3 Image を微調整・導入したい企業向けに商用重みライセンスを案内しています。この案内は、一般公開され、無料でダウンロードできるオープンウェイトのリリースを証明するものではありません。現在のライセンス条件はBFLに確認してください。FLUX 3 Image 重みガイドでは商用の提供と公開ダウンロードを区別しています。[4]
次の変更前に FLUX 3 Image の編集結果を確認する
最初の FLUX 3 Image 編集では、判断しやすい変更を1つ選び、残す必要のある要素を指定し、2回目の変更前に出力を確認してください。小さく確認可能な要件なら、最終素材に使える結果かを実際に判断できます。
参考資料
- Black Forest Labs. FLUX 3 Image Editing. 2026年10月9日閲覧: docs.bfl.ai/flux_3/flux3_image_layout.
- Black Forest Labs. Bounding boxes with FLUX 3 Image. 2026年10月9日閲覧: docs.bfl.ai/flux_3/flux3_image_bounding_boxes.
- Black Forest Labs. FLUX 3 Image overview. 2026年10月9日閲覧: docs.bfl.ai/flux_3/flux3_image_overview.
- Black Forest Labs. FLUX 3 Image. 2026年10月9日閲覧: bfl.ai/models/flux-3-image.
著者

カテゴリ
他の記事

Wan 3.0はオープンソース?重みとAPI、ローカル実行の全て
Wan 3.0はAPIで利用可能ですが、公開重みはありません(2026年8月時点)。利用可能な内容と、Wan 2.2がローカルの選択肢として機能する場合を解説します。


Seedance 2.5の開発元は?ByteDanceと関連サービス
Seedance 2.5の開発元はByteDance Seedです。BytePlus、火山引擎、Dreamina、即梦、豆包の関係と、公式モデルページや発表資料を確認できます。


動画アップスケーラー:video2xとReal-ESRGANガイド
オープンソース動画アップスケーラーガイド:video2xとReal-ESRGANの比較、GPU対応、アニメモデル、低VRAM対応とライセンス情報。
