
FLUX 3 Image : retouche, références et bounding boxes
Retouche avec FLUX 3 Image : ordonne les références, ajoute des bounding boxes au prompt, comprends les coordonnées et vérifie les zones restées inchangées.
FLUX 3 Image accepte jusqu'à dix images de référence, mais une retouche utile commence par une question plus précise : quelle partie de l'image doit changer ? Black Forest Labs documente la retouche par instruction et un format de mise en page qui nomme les éléments, leur attribue des cadres et distingue leurs positions initiales de leurs positions souhaitées.[1][2]
Ce guide explique comment choisir entre ces approches, écrire les données des cadres dans un prompt et vérifier le résultat. Les exemples sont des modèles de prompts illustratifs, pas des résultats de génération rapportés. La page du modèle FLUX 3 Image présente les réglages et tarifs reAPI actuels, et la documentation API décrit le contrat de requête.
À retenir
- Commence par une référence et une instruction précise lorsqu'un objet doit subir une modification clairement définie. Les cadres fournis manuellement sont facultatifs pour la retouche courante.[1]
- L'ordre des références compte :
ref_image_0désigne la première image etref_image_1la deuxième. Attribue un rôle clair à chacune.[2] - Place la description et le tableau d'éléments ensemble dans
prompt. Les bounding boxes ne sont pas un paramètre de requête distinct au premier niveau.[2] - Les coordonnées suivent
[top, left, bottom, right]sur une grille normalisée de 0 à 1000. Ce ne sont pas des coordonnées en pixels.[2] - Considère les cadres comme des indications de placement. BFL précise qu'ils ne fonctionnent pas comme des masques de découpe ; les pixels censés rester inchangés doivent aussi être inspectés.[2]
Commence la retouche FLUX 3 Image par une modification précise
Pour une seule image, écris une instruction qui identifie l'objet et le résultat souhaité. Le guide de BFL recommande de désigner l'élément assez précisément pour qu'un seul corresponde. Le modèle peut développer une instruction et déduire des cadres pour de nombreuses retouches ; un tableau d'éléments complet n'est pas nécessaire à chaque requête.[1]
Imagine une photo de produit avec une tasse crème sur une table en bois. Un premier prompt pourrait être :
Change the cream ceramic mug beside the closed notebook to a deep teal glaze.
Keep the mug's handle shape, the notebook, the wooden table, the camera angle,
and the soft light from the left unchanged.Cette instruction donne à la modification un sujet reconnaissable et définit les parties à inspecter ensuite. S'il y a deux tasses, précise laquelle. Si l'anse doit rester visible, indique-le. Une demande générale comme « améliore la photo » laisse ces choix au modèle.
Pour FLUX 3 Image, nous suggérons de commencer par la plus petite retouche clairement décrite. Ajoute des cadres explicites lorsque l'emplacement est ambigu, que plusieurs objets similaires sont présents ou que la composition doit changer. C'est une stratégie de retouche, pas une affirmation qu'une forme de prompt réussit toujours.
Attribue un rôle à chaque référence
FLUX 3 Image prend en charge jusqu'à dix références. BFL propose deux façons de les désigner : leur position, par exemple « Image 1 », ou leur identifiant indexé, à partir de ref_image_0. La première référence fournit aussi le format de sortie lorsqu'une requête de retouche utilise auto.[1][2]
Pour un concept de pièce, les rôles pourraient être :
| Référence | Rôle dans le prompt | À vérifier dans le résultat |
|---|---|---|
Image 1 / ref_image_0 | Pièce et point de vue | Position des fenêtres et cadrage de la pièce |
Image 2 / ref_image_1 | Fauteuil à placer près de la fenêtre | Forme, tissu et orientation du fauteuil |
Image 3 / ref_image_2 | Motif d'un coussin | Placement du motif sur le coussin |
Une instruction illustrative serait : « Utilise l'image 1 pour la pièce. Place le fauteuil de l'image 2 près de la fenêtre. Ajoute un coussin avec le motif de l'image 3. Conserve le point de vue et les meubles existants de la pièce. »
Conserve l'ordre des références dans le suivi de la tâche. Réordonner les entrées sans changer le prompt modifie l'image qui fournit chaque rôle. Remplir les dix emplacements apporte aussi peu d'intérêt si le brief n'en demande que deux. La limite utile dépend de la clarté avec laquelle tu peux expliquer la contribution de chaque référence.
Dans une requête FLUX 3 Image sur reAPI, fournis les URL dans image_urls. La référence API FLUX 3 Image documente les URL acceptées et les limites ; les identifiants du prompt commencent toujours à zéro.
Place les données de mise en page dans le prompt
FLUX 3 Image utilise une description suivie d'un tableau JSON d'éléments. Pour une nouvelle composition, chaque élément possède id, bbox et desc. Mentionne l'identifiant correspondant entre chevrons dans la description, puis ajoute le tableau à la même chaîne de prompt.[2]
Voici une mise en page carrée illustrative, avec une tasse à gauche et un carnet à droite :
A quiet overhead product photograph of a teal mug <mug_1> and a closed
cream notebook <notebook_1> on a pale wooden desk <desk_1>.
[
{"id":"desk_1","bbox":[0,0,1000,1000],"desc":"A pale wooden desk in soft daylight."},
{"id":"mug_1","bbox":[300,120,760,450],"desc":"One teal ceramic mug with its handle visible."},
{"id":"notebook_1","bbox":[230,540,820,900],"desc":"A closed cream notebook without lettering."}
]Les nombres décrivent des positions relatives. [0,0,500,500] représente le quart supérieur gauche de l'image. Changer la résolution ne transforme pas ces valeurs en pixels. Changer le format étire la grille avec le cadre de l'image ; utilise donc le format pour lequel tu as conçu la mise en page.[2]
Lors de la création d'une requête dans le code, sérialise le tableau et ajoute-le à la description. Cela évite d'échapper manuellement chaque guillemet dans un JSON imbriqué. N'envoie pas un champ bbox séparé simplement parce que le prompt contient des cadres.
La retouche utilise des cadres source et cible
Une retouche demande plus d'informations qu'une nouvelle mise en page : d'où vient l'élément et où doit-il arriver ? Le format de retouche FLUX 3 Image utilise from, src_bbox et tgt_bbox pour cela.[2]
| Opération souhaitée | from | src_bbox | tgt_bbox |
|---|---|---|---|
| Conserver un élément en place | Identifiant d'une référence | Cadre actuel | Même cadre |
| Déplacer ou redimensionner un élément | Identifiant d'une référence | Cadre actuel | Cadre différent |
| Ajouter, remplacer ou recolorer | null | null | Cadre de destination |
| Supprimer un élément | Identifiant d'une référence | Cadre actuel | null |
Par exemple, une ligne de déplacement de la tasse pourrait être :
{
"id": "mug_1",
"from": "ref_image_0",
"src_bbox": [300, 120, 760, 450],
"tgt_bbox": [300, 200, 760, 530],
"desc": "The teal ceramic mug with the same shape and visible handle."
}L'instruction associée doit préciser que la tasse se déplace vers la droite tandis que le carnet et le bureau restent inchangés. Ajoute des lignes de conservation pour les éléments qui doivent rester en place. Elles utilisent les mêmes coordonnées source et cible.
Pour une recoloration, le schéma documenté par BFL est une nouvelle ligne : from: null, src_bbox: null et un cadre cible décrivant l'apparence souhaitée. Pour une suppression, garde la référence et le cadre source, puis mets le cadre cible à null. Indique aussi la suppression dans l'instruction écrite. L'instruction et le tableau doivent être cohérents.[2]
Ces coordonnées appartiennent à la mise en page hypothétique ci-dessus. Mesure ta propre image avant de les réutiliser : un objet JSON valide peut viser le mauvais objet.
Choisis résolution et grounding selon le brief
FLUX 3 Image propose cinq niveaux de résolution : 768sq, 1k, 1.5k, 2k et 4k. Le niveau par défaut est 1k. Le grounding est activé par défaut et autorise des recherches sur le Web et dans les images avant la génération ; false désactive cette étape.[3]
Ces réglages répondent à des questions différentes. La résolution sélectionne le niveau de sortie. Le grounding décide si le modèle peut chercher des informations complémentaires au-delà du prompt et des entrées. Pour une composition de studio fictive, le désactiver peut convenir au processus prévu. Pour un sujet réel ou une référence visuelle actuelle, décide si la recherche est utile et vérifie quand même le résultat.
BFL décrit une génération native en 2K et 4K pour FLUX 3 Image, mais une sortie plus grande ne prouve pas qu'une petite retouche a préservé un visage, une étiquette ou une texture. Inspecte la zone importante à la taille livrée. Consulte les tarifs FLUX 3 Image actuels avant de choisir le niveau final plutôt que de reprendre un ancien tarif dans ton processus.[4]
Inspecte les parties inchangées aussi soigneusement que la retouche
La réserve la plus utile de la documentation BFL est que les cadres guident le placement et l'échelle ; ils ne découpent pas un élément avec un masque strict. L'exemple de suppression précise que les pixels hors des cadres modifiés restent généralement identiques. Cela invite à comparer les sorties, sans promettre une absence universelle de dérive.[2]
Pour l'exemple de la tasse, inspecte l'anse, le bord du carnet, le veinage du bois et la limite de l'ombre. Si plusieurs retouches sont nécessaires, garde la source approuvée et compare chaque résultat avec elle. Une nouvelle composition séduisante peut échouer à un brief qui exigeait de conserver le carnet original.
Une fiche de contrôle simple peut contenir l'ordre des entrées, le prompt, le tableau d'éléments, le format, la résolution et une courte note d'acceptation ou de rejet. Pour des retouches répétées, garde l'image précédemment acceptée disponible. C'est une procédure proposée ; cet article ne revendique ni taux de nouvelles tentatives mesuré ni précision de retouche mesurée.
Questions sur la retouche FLUX 3 Image
Peut-on retoucher une image sans bounding boxes ?
Oui. Envoie une référence et une instruction écrite. BFL documente la retouche directe et indique que le modèle peut déduire les cadres pour de nombreuses modifications. Fournis-les toi-même lorsque des indications explicites de placement sont nécessaires.[1]
Combien d'images de référence peut-on utiliser ?
Jusqu'à dix. Décris ce que fournit chaque image et conserve leur ordre. La première est ref_image_0 ; dans le langage courant, c'est « Image 1 ».[1]
Les bounding boxes sont-elles mesurées en pixels ?
Non. Elles utilisent des entiers normalisés de 0 à 1000, dans l'ordre [top,left,bottom,right]. Un cadre couvre la portion correspondante de l'image quelle que soit la résolution de sortie.[2]
L'image-to-image conserve-t-il le format original ?
Dans une requête de retouche avec aspect_ratio: "auto", la première référence fournit le format. Choisis un rapport explicite si la sortie doit avoir une autre forme, et conçois les cadres pour ce format.[1]
La conservation exacte des pixels hors du cadre est-elle garantie ?
Il ne faut pas le supposer. Le guide technique BFL nuance la conservation et précise que les cadres ne sont pas des masques de découpe. Compare le fichier retourné à la source partout où des pixels inchangés constituent un critère d'acceptation.[2]
Peut-on télécharger FLUX 3 Image pour un usage local ?
BFL annonce une licence commerciale de poids pour les entreprises souhaitant affiner et déployer FLUX 3 Image sur leur infrastructure. Cette offre ne prouve pas une publication open-weight publique et librement téléchargeable. Consulte BFL pour les conditions actuelles. Notre guide des poids FLUX 3 Image distingue l'offre commerciale d'un téléchargement public.[4]
Vérifie une retouche FLUX 3 Image avant la modification suivante
Pour ta première retouche FLUX 3 Image, choisis une modification facile à juger, nomme les éléments à conserver et inspecte la sortie avant d'en demander une deuxième. Un brief limité et vérifiable donne un moyen pratique de décider si le résultat convient au visuel final.
Références
- Black Forest Labs. FLUX 3 Image Editing. Consulté le 9 octobre 2026 : docs.bfl.ai/flux_3/flux3_image_layout.
- Black Forest Labs. Bounding boxes with FLUX 3 Image. Consulté le 9 octobre 2026 : docs.bfl.ai/flux_3/flux3_image_bounding_boxes.
- Black Forest Labs. FLUX 3 Image overview. Consulté le 9 octobre 2026 : docs.bfl.ai/flux_3/flux3_image_overview.
- Black Forest Labs. FLUX 3 Image. Consulté le 9 octobre 2026 : bfl.ai/models/flux-3-image.
Auteur

Catégories
Plus d'articles

API Grok Imagine Video 1.5 : tarification, 1080p et limites
Utilisez l'API Grok Imagine Video 1.5 pour générer des vidéos à partir d'images avec audio natif. Comparez 480p, 720p, 1080p, les limites et tarification reAPI.


API images IA : filtrage multi-couches et raisons des refus
Le filtrage multi-couches des images signifie qu'une requête peut être acceptée ou rejetée selon la plateforme, mais certains critères ne changent jamais.


Génération d'images IA vs vidéo : 2 à 9 fois plus cher
Le coût par mégapixel de la génération d'images IA dépasse de 2 à 9 fois celui d'une image vidéo. Calcul sur huit niveaux vidéo et sept modèles d'images.
