ControlNet spiegato: posa, profondità, contorni e immagini di riferimento per SD 1.5, SDXL e Flux
Argomento: Prompting
Di Captain
Pubblicato il 2026-02-18
Come ControlNet fa sì che un modello segua una posa, una mappa di profondità, un disegno di contorni o uno scarabocchio invece di indovinare la composizione dal prompt: i tipi di controllo più comuni e quando usare ciascuno, il passaggio del preprocessore, le impostazioni di forza e percentuale finale, i file specifici per famiglia e le alternative dell’era Flux (Flux Depth, Canny, Kontext).
Panoramica
Un prompt dice cosa disegnare; ControlNet dice dove. È una rete laterale, addestrata per famiglia, che legge un’immagine di controllo (una posa a bastoncino, una mappa di profondità, un disegno di contorni, uno scarabocchio, una mappa di segmentazione) e guida il denoiser affinché il risultato corrisponda a quella struttura. Il prompt decide ancora soggetto, stile e luce; l’immagine di controllo fissa la composizione. È così che si ottiene la stessa posa su dieci personaggi, si trasforma un render 3D in una foto o si mantiene la forma esatta di un prodotto.
Due passaggi succedono sempre. Prima un preprocessore trasforma la tua foto sorgente nell’immagine di controllo (OpenPose disegna lo scheletro, MiDaS o Depth Anything stimano la profondità, Canny trova i contorni, Lineart traccia i contorni). Poi il modello ControlNet per la tua famiglia usa quell’immagine durante la generazione. Dare la foto grezza invece della mappa preprocessata è l’errore numero uno dei principianti; il secondo è usare un ControlNet
SD 1.5
su un
checkpoint
SDXL
.
Flux
e i modelli 2025 hanno cambiato le cose: Black Forest Labs distribuisce Flux Depth e Flux Canny come modelli completi e
LoRA
, Union ControlNets coprono diversi tipi in un file per SDXL e Flux, e gli editor di istruzioni (
Qwen Image
Edit, Kontext) gestiscono molti lavori di "mantieni questo, cambia quello" senza un’immagine di controllo. Il catalogo su questo sito etichetta i ControlNet sotto "altro" con la loro famiglia; la pagina del modello nomina il tipo di controllo.
Riferimento
Nome | Tipo | Cos'è |
|---|---|---|
OpenPose | control type | Punti chiave di corpo, mani e volto come figura a bastoncino. Trasferimento posa, coreografia, personaggi coerenti. Debole sulle mani a meno che il modello mani non sia attivo. |
Depth (MiDaS, Zoe, Depth Anything) | control type | Mappa di profondità in scala di grigi. Mantiene la disposizione spaziale e la camera permettendo un completo restyling. Il controllo più permissivo per foto a illustrazione. |
Canny / Lineart / SoftEdge (HED) | control type | Disegni di contorni. Canny è preciso e netto, Lineart per disegni, SoftEdge più morbido. Forme di prodotti, architettura, loghi. |
Scribble | control type | Tratti grezzi che disegni tu stesso diventano una composizione. Forza bassa (0.5-0.7) o il risultato sembra lo scarabocchio. |
Tile | control type | Guida un passaggio di upscaling o dettaglio per restare fedele all’input a bassa risoluzione. Il motore dietro la maggior parte dei flussi di lavoro "upscaling definitivo". |
IP-Adapter / Redux / reference | image conditioning | Non è un ControlNet: condiziona lo stile o il volto di un’immagine invece della sua struttura. Si combina con un ControlNet per avere entrambi. |
Strength / weight | 0.4-1.0 | Quanto viene applicata la struttura. 0.8 per posa e profondità, 0.5-0.7 per contorni e scarabocchio. |
Start / end percent | 0.0-1.0 | A quale parte del denoising si applica il controllo. Finire a 0.6-0.8 lascia al modello la libertà di finire i dettagli e toglie l’effetto "tracciato". |
Family files | SD 1.5: lllyasviel control_v11 | SDXL: diffusers / xinsir Union | Flux: Flux Depth/Canny, Shakker Union, InstantX | Ogni famiglia ha bisogno del suo ControlNet; dimensioni 0.7-2.5 GB. I file Union raggruppano più tipi. |
AD

Controllo posa e profondità nel browser
BitVector Prism include controllo posa e profondità per i suoi modelli SDXL e Flux: carica un riferimento, scegli il controllo, scrivi il prompt. Nessun preprocessore da installare.
Passo dopo passo
- Scegli il tipo di controllo per il lavoro: posa per persone, profondità per scene e restyling, Canny o Lineart per forme nette, scarabocchio per idee, tile per upscaling.
- Carica la tua immagine sorgente e usa il preprocessore corrispondente (ComfyUI: i nodi controlnet_aux; A1111: l’estensione ControlNet lo fa inline). Anteprima l’immagine di controllo; correggila se lo scheletro ha perso un arto.
- ComfyUI: Applica ControlNet (Advanced) tra CLIP Text Encode e KSampler, collega l’immagine di controllo e il modello ControlNet, forza 0.8, inizio 0, fine 0.8.
- A1111 / Forge: abilita ControlNet unità 0, scegli preprocessore e modello dello stesso tipo, peso 0.8, passo di controllo finale 0.8, pixel perfect attivo.
- Scrivi il prompt per quello che vuoi vedere, non per la posa (la posa è gestita). Genera quattro seed.
- Abbassa forza o percentuale finale se l’immagine sembra tracciata o piatta; alzale se la struttura si perde. Metti una seconda unità (posa + profondità) per composizioni ostinate.
- Sul cloud,PirateDiffusionapplica ControlNet quando rispondi a un’immagine sorgente con /render e un flag di controllo;BitVectoroffre posa e profondità nei suoi strumenti immagine.
Esempi
Trasferimento posa in ComfyUI (SDXL)
Load Image (reference photo) -> DWPose Estimator (body + hands) -> Apply ControlNet Advanced (xinsir controlnet-union-sdxl, type openpose, strength 0.8, end 0.75) -> KSampler
Prompt: a knight in weathered plate armour standing on a cliff at dawn, cinematic, 35mm
Foto a acquerello con profondità (A1111 / Forge)
ControlNet unit 0: preprocessor depth_anything, model control_sdxl_depth, weight 0.7, end 0.7, pixel perfect
Prompt: loose watercolour illustration of a harbour town, paper texture, soft morning light
Flux Canny LoRA
Load Diffusion Model (flux1-dev-fp8) -> LoraLoaderModelOnly (flux1-canny-dev-lora, 0.85) -> InstructPixToPixConditioning (canny image) -> KSampler (guidance 30)
Consigli
- La profondità batte Canny per foto a illustrazione perché lascia libera la texture; Canny batte profondità per loghi e prodotti perché mantiene i contorni precisi.
- La percentuale finale è l’impostazione che la maggior parte delle persone non tocca mai e quella che risolve l’aspetto plastico e tracciato.
- Ridimensiona l’immagine di controllo alla dimensione di generazione mantenendo lo stesso rapporto d’aspetto; forme diverse tagliano lo scheletro.
- OpenPose da una tua foto è il modo più veloce per avere una libreria di pose coerenti per un personaggio.
- Per Flux, le LoRA Depth e Canny di Black Forest Labs sono più leggere dei modelli di controllo completi e abbastanza buone per la maggior parte dei lavori.
- Gli editor di istruzioni (Qwen Image Edit, Kontext) spesso sostituiscono un passaggio ControlNet per modifiche "stessa scena, soggetto diverso"; vedi la guida Qwen Image Edit.
Risoluzione dei problemi
ControlNet non fa nulla
Perché succede
Famiglia sbagliata (ControlNet SD 1.5 su SDXL), o è stata data la foto grezza invece della mappa preprocessata.
Come risolverlo
Usa la famiglia giusta; esegui il preprocessore e controlla l’anteprima.
Risultato sembra tracciato e piatto
Perché succede
Forza 1.0 con percentuale finale 1.0.
Come risolverlo
Forza 0.7, fine 0.7; lascia che il modello finisca da solo.
Lo scheletro perde mani o un arto
Perché succede
Preprocessore ha rilevato male su una foto disordinata.
Come risolverlo
Usa DWPose con mani attivate, ritaglia la sorgente o modifica lo scheletro in un nodo editor OpenPose.
Memoria esaurita con due unità
Perché succede
Ogni ControlNet pesa fino a 2.5 GB.
Come risolverlo
ControlNet Flux genera rumore
Perché succede
Come risolverlo
Usa il nodo indicato nella pagina del modello e CFG 1 con la guida indicata.
AD

ControlNet rispondendo a una foto
Su PirateDiffusion rispondi a qualsiasi immagine su Telegram con /render e un flag di controllo e il ControlNet giusto per il modello viene applicato lato server. Render illimitati a prezzo fisso.
Domande
ControlNet è una LoRA?
No. È una rete separata che legge un’immagine; una LoRA cambia i pesi del modello dal testo. Le "LoRA" Depth e Canny di Flux sono un’eccezione: modelli di controllo distribuiti in forma LoRA.
Posso usare ControlNet con video?
Sì:
Wan
VACE e i Wan Fun ControlNet prendono sequenze di posa o profondità; le guide video su questo sito li coprono.
Devo installare i modelli preprocessori?
Sì, si scaricano al primo uso (controlnet_aux in ComfyUI, l’estensione in A1111). Sono piccoli.
Qual è meglio, IP-Adapter o ControlNet?
Lavori diversi: IP-Adapter copia lo stile o l’identità da un’immagine, ControlNet copia la struttura. Molti flussi usano entrambi.
Funziona sul cloud?
PirateDiffusion e BitVector hanno i ControlNet per i loro modelli installati; tu fornisci l’immagine sorgente e il tipo di controllo.
Link e fonti
- ControlNet paper (Zhang et al., 2023)
- ControlNet 1.1 models (lllyasviel)
- ComfyUI controlnet_aux preprocessors
- SDXL family page
- Flux family page
- PirateDiffusion
Modelli di questa guida
Scritto da
Captain
Guide correlate
Modelli
Checkpoint vs LoRA vs embedding vs ControlNet: a cosa serve ogni file
I sei tipi di file modello che incontrerai, cosa cambia ciascuno, quanto sono grandi, dove vanno messi e quando usarli: checkpoint e fine-tune, LoRA e i loro cugini LyCORIS, embedding di inversione testuale, ControlNet e IP-Adapter, VAE e upscaler.
Di Quartermaster
2025-10-08
Prompting
Basi di img2img, inpainting e outpainting: correggere le mani, scambiare oggetti ed estendere un'immagine
I tre modi per generare a partire da un'immagine esistente invece che dal rumore: img2img per restyling con un valore di denoise, inpainting per ridipingere solo un'area mascherata (la correzione standard per mani e volti), e outpainting per estendere la tela; con le scelte di denoise, padding e modello per SD 1.5, SDXL, Flux Fill e Qwen Image Edit.
Di Captain
2025-12-03
Prompting
Guida a Qwen-Image-Edit: prompt di istruzioni, modifica multi-immagine e i LoRA che la migliorano
Come ottenere modifiche pulite da Qwen-Image-Edit: scrivere istruzioni invece di descrizioni, mantenere identità e layout, input multi-immagine, sostituzione del testo, controllo di posa e profondità, i LoRA lightning per modifiche in 4 passaggi e i LoRA anything-to-real e slider che stanno andando di moda nella famiglia Qwen2.
Di Captain
2026-05-26
ComfyUI
Cos'è ComfyUI? Una guida per principianti ai nodi, ai flussi di lavoro e al primo grafo
ComfyUI spiegato per chi viene da Automatic1111, Fooocus o un'app web: perché è un grafo, i sette nodi nel flusso di lavoro predefinito e cosa fa ciascuno, come caricare un flusso di lavoro da un'immagine, dove vanno i modelli, il Manager per i nodi mancanti e quando è meglio usare uno strumento più semplice o il cloud.
Di Lookout
2025-12-17
Modelli
Ingrandimento delle immagini AI: modelli ESRGAN, hires-fix, diffusione a piastrelle e quando usarli
Le tre famiglie di ingrandimento e a cosa servono: ingranditori pixel veloci (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) per un ingrandimento pulito, hires-fix per aggiungere dettagli durante la generazione, e diffusione a piastrelle (Ultimate SD Upscale, SUPIR, basati su Flux) per trasformare un render 1024 in una stampa 4K dettagliata; con valori di denoise, dimensioni delle piastrelle e modelli da scaricare.
Di Quartermaster
2026-03-04
Altre guide
Modelli
FLUX.1 Dev: come usarlo, impostazioni migliori e idee creative
Una guida pratica a FLUX.1 Dev di Black Forest Labs: come scrivere i prompt in linguaggio naturale, impostazioni di guida e passi, stacking di LoRA, rendering del testo e idee per prompt che sfruttano i suoi punti di forza.
Di Captain
2026-09-30
Modelli
Stable Diffusion XL 1.0: prompt, impostazioni e cosa fa ancora meglio
Come ottenere il massimo dal modello base ufficiale SDXL 1.0: risoluzioni native, impostazioni di CFG e sampler, il refiner, prompt negativi e idee per stili in cui SDXL brilla ancora.
Di Captain
2026-10-01
Modelli
Stable Diffusion 1.5: il modello classico, usato nel modo giusto
Stable Diffusion 1.5 vale ancora la pena conoscerlo: la risoluzione giusta, CFG e sampler, come usare la sua enorme libreria di LoRA e embedding, e idee creative per prompt adatte a un modello a 512 pixel.
Di Captain
2026-10-02
Modelli
FLUX.2 Dev: come usare il modello più recente di Black Forest Labs
FLUX.2 Dev supporta prompt più lunghi, testo migliore, realismo più forte e modifica con riferimenti multipli. Questa guida spiega il flusso turbo, le impostazioni di guida e risoluzione, la struttura del prompt e idee che sfruttano le sue nuove potenzialità.
Di Captain
2026-10-03
Modelli
Qwen-Image: prompt lunghi, testo perfetto e poster bilingue
Qwen-Image è il modello da usare quando le parole nell'immagine contano. Scopri come scrivere prompt descrittivi lunghi, riprodurre testo in inglese e cinese con precisione, impostare CFG e passi, e esplorare idee creative con layout complessi.
Di Captain
2026-09-29
Modelli
SDXL-Lightning: generazione in quattro passaggi su qualsiasi checkpoint SDXL
Lo LoRA SDXL-Lightning di ByteDance trasforma un rendering SDXL da 30 passaggi in uno da 4. Scopri il numero di passaggi, il CFG da usare, il sampler e come combinarlo con i tuoi checkpoint e LoRA di stile preferiti.
Di Captain
2026-09-30

Model
Trends
.ai
© ModelTrends.ai
|
Fatto in Giappone
|
© 2026