ControlNet expliqué : pose, profondeur, contours et images de référence pour SD 1.5, SDXL et Flux
Sujet : Prompting
Par Captain
Publié le 2026-02-18
Comment ControlNet fait en sorte qu’un modèle suive une pose, une carte de profondeur, un dessin de contours ou un gribouillis au lieu de deviner la composition à partir du prompt : les types de contrôle courants et quand les utiliser, l’étape de prétraitement, les réglages de force et de pourcentage de fin, les fichiers spécifiques à chaque famille, et les alternatives de l’ère Flux (Flux Depth, Canny, Kontext).
Aperçu
Un prompt dit quoi dessiner ; ControlNet dit où. C’est un réseau secondaire, entraîné par famille, qui lit une image de contrôle (une pose en bâtonnets, une carte de profondeur, un dessin de contours, un gribouillis, une carte de segmentation) et guide le débruiteur pour que le résultat corresponde à cette structure. Le prompt décide toujours du sujet, du style et de la lumière ; l’image de contrôle fixe la composition. C’est comme ça que les gens obtiennent la même pose sur dix personnages, transforment un rendu 3D en photo, ou gardent la forme exacte d’un produit.
Deux étapes se passent toujours. D’abord un préprocesseur transforme ta photo source en image de contrôle (OpenPose dessine le squelette, MiDaS ou Depth Anything estiment la profondeur, Canny trouve les contours, Lineart trace les lignes). Ensuite le modèle ControlNet de ta famille utilise cette image pendant la génération. Donner la photo brute au lieu de la carte prétraitée est la première erreur des débutants ; la deuxième est d’utiliser un ControlNet
SD 1.5
sur un
checkpoint
SDXL
.
Flux
et les modèles 2025 ont changé la donne : Black Forest Labs propose Flux Depth et Flux Canny comme modèles complets et
LoRA
, les Union ControlNets couvrent plusieurs types dans un seul fichier pour SDXL et Flux, et les éditeurs d’instructions (
Qwen Image
Edit, Kontext) gèrent beaucoup de tâches « garder ça, changer ça » sans image de contrôle. Le catalogue sur ce site classe les ControlNets sous « autres » avec leur famille ; la page du modèle précise le type de contrôle.
Référence
Nom | Type | Rôle |
|---|---|---|
OpenPose | control type | Points clés du corps, des mains et du visage sous forme de bâtonnets. Transfert de pose, chorégraphie, personnages cohérents. Faible sur les mains sauf si le modèle main est activé. |
Depth (MiDaS, Zoe, Depth Anything) | control type | Carte de profondeur en gris. Garde la disposition spatiale et la caméra tout en permettant un relooking complet. Le contrôle le plus indulgent pour passer de photo à illustration. |
Canny / Lineart / SoftEdge (HED) | control type | Dessins de contours. Canny est strict et net, Lineart pour les dessins, SoftEdge plus lâche. Formes de produits, architecture, logos. |
Scribble | control type | Traits grossiers que tu dessines toi-même deviennent une composition. Faible force (0.5-0.7) sinon le résultat ressemble au gribouillis. |
Tile | control type | Guide un passage d’agrandissement ou de détail pour rester fidèle à l’entrée basse résolution. Le moteur derrière la plupart des workflows « agrandissement ultime ». |
IP-Adapter / Redux / reference | image conditioning | Pas un ControlNet : conditionne sur le style ou le visage d’une image plutôt que sur sa structure. Combine avec un ControlNet pour avoir les deux. |
Strength / weight | 0.4-1.0 | À quel point la structure est imposée. 0.8 pour pose et profondeur, 0.5-0.7 pour contours et gribouillis. |
Start / end percent | 0.0-1.0 | À quelle partie du débruitage le contrôle s’applique. Finir à 0.6-0.8 laisse le modèle finir les détails librement et enlève l’aspect « tracé ». |
Family files | SD 1.5: lllyasviel control_v11 | SDXL: diffusers / xinsir Union | Flux: Flux Depth/Canny, Shakker Union, InstantX | Chaque famille a besoin de son propre ControlNet ; tailles 0.7-2.5 Go. Les fichiers Union regroupent plusieurs types. |
AD

Contrôle de pose et profondeur dans le navigateur
BitVector Prism inclut le contrôle de pose et de profondeur pour ses modèles SDXL et Flux : télécharge une référence, choisis le contrôle, tape le prompt. Pas besoin d’installer des préprocesseurs.
Pas à pas
- Choisis le type de contrôle selon le boulot : pose pour les gens, profondeur pour les scènes et le relooking, Canny ou Lineart pour les formes dures, gribouillis pour les idées, tile pour l’agrandissement.
- Charge ton image source et lance le préprocesseur correspondant (ComfyUI : les nœuds controlnet_aux ; A1111 : l’extension ControlNet le fait en ligne). Prévisualise l’image de contrôle ; corrige-la si le squelette a raté un membre.
- ComfyUI : applique ControlNet (Advanced) entre CLIP Text Encode et KSampler, branche l’image de contrôle et le modèle ControlNet, force 0.8, début 0, fin 0.8.
- A1111 / Forge : active l’unité ControlNet 0, choisis le préprocesseur et le modèle du même type, poids 0.8, étape de fin 0.8, pixel perfect activé.
- Écris le prompt pour ce que tu veux voir, pas pour la pose (la pose est gérée). Génère quatre seeds.
- Baisse la force ou le pourcentage de fin si l’image semble tracée ou plate ; augmente-les si la structure dérive. Ajoute une deuxième unité (pose + profondeur) pour les compositions tenaces.
- Sur le cloud,PirateDiffusionapplique ControlNet quand tu réponds à une image source avec /render et un flag de contrôle ;BitVectorpropose pose et profondeur dans ses outils d’image.
Exemples
Transfert de pose dans ComfyUI (SDXL)
Load Image (reference photo) -> DWPose Estimator (body + hands) -> Apply ControlNet Advanced (xinsir controlnet-union-sdxl, type openpose, strength 0.8, end 0.75) -> KSampler
Prompt: a knight in weathered plate armour standing on a cliff at dawn, cinematic, 35mm
Photo vers aquarelle avec profondeur (A1111 / Forge)
ControlNet unit 0: preprocessor depth_anything, model control_sdxl_depth, weight 0.7, end 0.7, pixel perfect
Prompt: loose watercolour illustration of a harbour town, paper texture, soft morning light
Flux Canny LoRA
Load Diffusion Model (flux1-dev-fp8) -> LoraLoaderModelOnly (flux1-canny-dev-lora, 0.85) -> InstructPixToPixConditioning (canny image) -> KSampler (guidance 30)
Astuces
- La profondeur est meilleure que Canny pour passer de photo à illustration parce qu’elle laisse la texture libre ; Canny est meilleure que la profondeur pour les logos et produits parce qu’elle garde les contours précis.
- Le pourcentage de fin est le réglage que la plupart des gens ne touchent jamais et qui corrige l’aspect plastique, tracé.
- Redimensionne l’image de contrôle à la taille de génération avec le même ratio ; des formes décalées coupent le squelette.
- OpenPose à partir d’une photo de toi est la façon la plus rapide d’avoir une bibliothèque de poses cohérente pour un personnage.
- Pour Flux, les LoRA Depth et Canny de Black Forest Labs sont plus légères que les modèles complets de contrôle et assez bonnes pour la plupart des tâches.
- Les éditeurs d’instructions (Qwen Image Edit, Kontext) remplacent souvent un passage ControlNet pour des modifications « même scène, sujet différent » ; vois le guide Qwen Image Edit.
Dépannage
ControlNet ne fait rien
Pourquoi cela arrive
Incompatibilité de famille (ControlNet SD 1.5 sur SDXL), ou la photo brute a été utilisée au lieu de la carte prétraitée.
Comment le corriger
Prends la bonne famille ; lance le préprocesseur et vérifie sa sortie.
Résultat tracé et plat
Pourquoi cela arrive
Force à 1.0 avec pourcentage de fin à 1.0.
Comment le corriger
Force 0.7, fin 0.7 ; laisse le modèle finir seul.
Le squelette manque des mains ou un membre
Pourquoi cela arrive
Le préprocesseur a mal détecté sur une photo encombrée.
Comment le corriger
Utilise DWPose avec mains activées, recadre la source, ou modifie le squelette dans un nœud éditeur OpenPose.
Manque de mémoire avec deux unités
Pourquoi cela arrive
Chaque ControlNet fait jusqu’à 2.5 Go.
Comment le corriger
ControlNet Flux génère du bruit
Pourquoi cela arrive
Comment le corriger
Utilise le nœud indiqué sur la page du modèle et CFG 1 avec guidance selon la page.
AD

ControlNet en répondant à une photo
Sur PirateDiffusion tu réponds à n’importe quelle image dans Telegram avec /render et un flag de contrôle, et le bon ControlNet est appliqué côté serveur. Rendus illimités à prix fixe.
Questions
ControlNet est-il une LoRA ?
Non. C’est un réseau séparé qui lit une image ; une LoRA modifie les poids du modèle à partir du texte. Les LoRA Depth et Canny de Flux sont une exception : des modèles de contrôle livrés sous forme de LoRA.
Puis-je utiliser ControlNet avec la vidéo ?
Oui :
Wan
VACE et les Wan Fun ControlNets prennent des séquences de pose ou de profondeur ; les guides vidéo sur ce site les couvrent.
Faut-il installer les modèles préprocesseurs ?
Oui, ils se téléchargent à la première utilisation (controlnet_aux dans ComfyUI, l’extension dans A1111). Ils sont petits.
Lequel est mieux, IP-Adapter ou ControlNet ?
Pour des tâches différentes : IP-Adapter copie le look ou l’identité d’une image, ControlNet copie la structure. Beaucoup de workflows utilisent les deux.
Ça marche sur le cloud ?
PirateDiffusion et BitVector ont les ControlNets installés pour leurs modèles ; tu fournis l’image source et le type de contrôle.
Liens et sources
- ControlNet paper (Zhang et al., 2023)
- ControlNet 1.1 models (lllyasviel)
- ComfyUI controlnet_aux preprocessors
- SDXL family page
- Flux family page
- PirateDiffusion
Modèles de ce guide
Écrit par
Captain
Guides associés
Modèles
Checkpoint vs LoRA vs embedding vs ControlNet : à quoi sert chaque fichier
Les six types de fichiers modèles que tu vas rencontrer, ce que chacun modifie, leur taille, où les mettre et quand les utiliser : checkpoints et fine-tunes, LoRAs et leurs cousins LyCORIS, embeddings d'inversion textuelle, ControlNets et IP-Adapters, VAEs et upscalers.
Par Quartermaster
2025-10-08
Prompting
Bases de img2img, inpainting et outpainting : corriger les mains, échanger des objets et étendre une image
Les trois façons de générer à partir d’une image existante au lieu du bruit : img2img pour restyler avec une valeur de débruitage, inpainting pour repeindre seulement une zone masquée (la méthode standard pour corriger mains et visages), et outpainting pour étendre la toile ; avec les choix de débruitage, de marge et de modèle pour SD 1.5, SDXL, Flux Fill et Qwen Image Edit.
Par Captain
2025-12-03
Prompting
Guide Qwen-Image-Edit : instructions, édition multi-images et les LoRAs qui améliorent tout ça
Comment obtenir des modifications propres avec Qwen-Image-Edit : écrire des instructions au lieu de descriptions, garder l’identité et la mise en page, entrées multi-images, remplacement de texte, contrôle de pose et profondeur, les LoRAs lightning pour des éditions en 4 étapes et les LoRAs anything-to-real et sliders qui cartonnent dans la famille Qwen2.
Par Captain
2026-05-26
ComfyUI
Qu'est-ce que ComfyUI ? Un guide pour débutants sur les nœuds, les workflows et le premier graphe
ComfyUI expliqué pour ceux qui viennent d'Automatic1111, Fooocus ou d'une application web : pourquoi c'est un graphe, les sept nœuds du workflow par défaut et leur rôle, comment charger un workflow depuis une image, où placer les modèles, le Manager pour les nœuds manquants, et quand un outil plus simple ou le cloud est un meilleur choix.
Par Lookout
2025-12-17
Modèles
Agrandissement des images IA : modèles ESRGAN, hires-fix, diffusion en tuiles et quand utiliser chacun
Les trois familles d’agrandissement et leur usage : les agrandisseurs rapides par pixels (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) pour un agrandissement propre, hires-fix pour ajouter du détail lors de la génération, et la diffusion en tuiles (Ultimate SD Upscale, SUPIR, Flux-based) pour transformer un rendu 1024 en une impression 4K détaillée ; avec les valeurs de débruitage, tailles de tuiles et les modèles à télécharger.
Par Quartermaster
2026-03-04
Autres guides
Modèles
FLUX.1 Dev : comment le guider, meilleurs réglages et idées créatives
Un guide pratique pour FLUX.1 Dev de Black Forest Labs : comment utiliser des instructions en langage naturel, réglages de guidage et d’étapes, empilement de LoRA, rendu de texte et idées de prompts qui exploitent ses points forts.
Par Captain
2026-09-30
Modèles
Stable Diffusion XL 1.0 : prompts, réglages et ce qu'il fait encore de mieux
Comment tirer le meilleur parti du modèle de base officiel SDXL 1.0 : résolutions natives, réglages CFG et sampler, le refiner, prompts négatifs et idées de styles où SDXL brille encore.
Par Captain
2026-10-01
Modèles
Stable Diffusion 1.5 : le modèle classique, bien utilisé
Stable Diffusion 1.5 vaut toujours le coup : la bonne résolution, CFG et sampler, comment utiliser sa grande bibliothèque de LoRAs et embeddings, et des idées de prompts créatifs adaptés à un modèle 512 pixels.
Par Captain
2026-10-02
Modèles
FLUX.2 Dev : comment utiliser le nouveau modèle de Black Forest Labs
FLUX.2 Dev permet des prompts plus longs, un meilleur texte, un réalisme renforcé et une édition multi-références. Ce guide explique le workflow turbo, les réglages de guidance et de résolution, la structure du prompt et des idées qui tirent parti de ses nouvelles capacités.
Par Captain
2026-10-03
Modèles
Qwen-Image : longues invites, texte parfait et affiches bilingues
Qwen-Image est le modèle à utiliser quand les mots dans l’image comptent. Apprends à écrire ses longues invites descriptives, à rendre le texte anglais et chinois avec précision, à régler le CFG et les étapes, et à explorer des idées créatives avec beaucoup de mise en page.
Par Captain
2026-09-29
Modèles
SDXL-Lightning : génération en quatre étapes sur n'importe quel checkpoint SDXL
Le LoRA SDXL-Lightning de ByteDance transforme un rendu SDXL de 30 étapes en un rendu de 4 étapes. Découvre le nombre d'étapes, le CFG à utiliser, le sampler, et comment le combiner avec tes checkpoints et LoRAs de style préférés.
Par Captain
2026-09-30

Model
Trends
.ai
© ModelTrends.ai
|
Fabriqué au Japon
|
© 2026