Model
Trends
.ai
Model
Trends
.ai
i migliori modelli di IA open source

Errori e soluzioni di Stable Diffusion WebUI Forge (Flux, SDXL, poca VRAM)

Argomento: Errori e soluzioni
Di Captain
Pubblicato il 2026-05-16
Problemi specifici di Forge e come risolverli: Flux che non si carica o produce rumore, il cambio tipo UI (sd / xl / flux), il cursore "GPU Weights" e gli errori di memoria esaurita, mancanza di text encoder e VAE per Flux, rottura di ControlNet ed estensioni, e le differenze da Automatic1111 che confondono gli utenti.

Panoramica

Forge è il fork di lllyasviel di
Automatic1111
WebUI costruito su un backend nuovo con gestione aggressiva della memoria. Fa girare
Flux dev
su schede da 6 a 8 GB e
SDXL
su 4 GB, per questo molti lo scelgono. Il prezzo è una serie di errori che gli utenti A1111 non hanno visto: un cambio modalità UI che deve corrispondere al modello, un cursore GPU Weights che decide se il modello entra, e file separati per
Flux
(modello di diffusione, due text encoder, VAE) che devono esserci tutti.
La regola che risolve metà dei problemi di Forge: il selettore UI in alto a sinistra (sd, xl, flux, all) deve corrispondere al
checkpoint
, e per Flux la casella VAE / Text Encoder deve elencare ae.safetensors, clip_l.safetensors e un file t5xxl. L'altra metà è il valore di GPU Weights: troppo alto causa esaurimento memoria, troppo basso rallenta ma funziona.
Alternative ospitate per quello che ancora non entra:
PirateDiffusion
serve Flux, SDXL e le famiglie più nuove tramite workflow ospitati da Telegram, e
BitVector
fa girare gli stessi modelli in un'app web e su Discord. Le pagine modello su questo sito hanno una casella Run per entrambi.

Riferimento

Nome
Tipo
Cos'è
Selettore UI (sd / xl / flux / all)
setting
Sceglie la modalità backend e quali menu a tendina mostra. Un checkpoint Flux sotto "xl" fallisce con errore di forma o NoneType.
GPU Weights (MB)
setting
Quanto del modello resta sulla GPU. Lascia circa 1.5-2 GB liberi per le attivazioni: su una scheda da 12 GB imposta 9000-10000 per Flux.
Metodo Swap / Posizione Swap
setting
Queue vs Async, CPU vs Shared. Async più Shared è il più veloce su Windows con driver moderno; Queue più CPU è il fallback sicuro.
Diffusione in Low Bits
setting
Automatic sceglie fp8 per Flux. Impostalo su bnb-nf4 per checkpoint NF4 o fp8_e4m3fn per quelli fp8; un mismatch produce rumore.
VAE / Text Encoder
setting
Per Flux seleziona ae.safetensors, clip_l.safetensors e t5xxl_fp16 o t5xxl_fp8_e4m3fn. Mancando t5 si ottengono immagini vuote o spazzatura.
models/text_encoder, models/VAE
folders
Dove Forge cerca gli encoder Flux e VAE. Gli utenti A1111 spesso li mettono per errore nella cartella checkpoint.
CUDA out of memory / Allocation on device
error
GPU Weights troppo alto per risoluzione e batch. Abbassalo di 1000 MB alla volta.
NoneType has no attribute ... in forge_loader
error
Modalità UI sbagliata per il modello, o un
LoRA
di un'altra famiglia.
Errori di estensione all'avvio
error
Le estensioni A1111 che agganciano il vecchio backend (alcuni fork di
ControlNet
, versioni di Adetailer, Dynamic Prompts) si rompono su Forge. Usa le versioni compatibili con Forge.
AD
Nessuna installazione: esegui i modelli IA nel cloud
BitVector Prism è il modo più semplice per iniziare: scegli un modello, scrivi un prompt e genera in una web app pulita, senza configurare nulla. BitVector è disponibile anche su Discord e sul web (SpyGlass).

Passo dopo passo

  1. Installa dal pacchetto ufficiale one-click o git clone; esegui update.bat una volta, poi run.bat. Forge include Python e torch propri.
  2. Metti i file nelle cartelle Forge: checkpoint e modelli di diffusione Flux in models/Stable-diffusion, text encoder in models/text_encoder, VAE in models/VAE, LoRA in models/Lora. Forge legge anche una struttura cartelle A1111 tramite webui-user.bat --ckpt-dir e --lora-dir.
  3. Cambia il selettore UI alla famiglia del modello che carichi. Per Flux dev fp8 scegli flux, poi in VAE / Text Encoder spunta ae.safetensors, clip_l.safetensors e t5xxl_fp8_e4m3fn.safetensors.
  4. Imposta GPU Weights:
    VRAM
    totale in MB meno circa 2000 per immagini 1024 pixel, meno 3000 se usi hires fix o ControlNet. Genera una volta; se fallisce per memoria esaurita, abbassa di 1000 e riprova.
  5. Lascia Diffusion in Low Bits su Automatic a meno che non hai scaricato un checkpoint NF4 (allora bnb-nf4). Le pagine modello Flux su questo sito indicano la quantizzazione nella lista file.
  6. Impostazioni Flux diverse da SDXL: Distilled
    CFG
    Scale 3.5 e CFG 1, 20-28 passi, Euler con schedule Simple. I prompt negativi sono ignorati a CFG 1.
  7. Se le estensioni falliscono, avvia con --disable-all-extensions, poi abilita le versioni mantenute da Forge (ControlNet integrato, FreeU integrato e Kohya HRFix sono già presenti).
  8. Per video o modelli oltre Forge (
    Wan
    ,
    Qwen-Image
    ,
    HunyuanVideo
    ), passa a
    ComfyUI
    o usali ospitati su BitVector o PirateDiffusion; Forge è una UI per immagini.

Esempi

webui-user.bat che condivide una cartella modello A1111

set COMMANDLINE_ARGS=--ckpt-dir D:\sd\models\Stable-diffusion --lora-dir D:\sd\models\Lora --vae-dir D:\sd\models\VAE

Impostazioni Flux dev fp8

UI: flux | Checkpoint: flux1-dev-fp8.safetensors | VAE/Text Encoder: ae.safetensors, clip_l.safetensors, t5xxl_fp8_e4m3fn.safetensors
Steps 24 | Sampler Euler | Schedule Simple | CFG 1 | Distilled CFG 3.5 | 1024x1024 | GPU Weights 9500 (12 GB card)

Consigli

  • Forge include ControlNet, FreeU, Kohya HRFix, SAG e altro come integrati; rimuovi le versioni A1111 dalla cartella extensions prima di migrare.
  • Il checkpoint NF4 Flux (circa 6.8 GB con encoder integrati) è il Flux più semplice su schede da 8 GB; la versione fp8 con encoder separati dà dettagli leggermente migliori su 12 GB.
  • Imposta Metodo Swap su Async e Posizione Swap su Shared, genera, poi torna a Queue/CPU se il driver fa problemi. Async può raddoppiare la velocità su schede da 8 GB.
  • Il seed, sampler e CFG da un PNG A1111 si riproducono su Forge per
    SD 1.5
    e SDXL; le immagini Flux hanno bisogno anche del valore Distilled CFG.
  • Mantieni i pesi LoRA per Flux tra 0.6 e 0.9; i LoRA Flux saturano più in fretta di quelli SDXL. Le parole trigger sono su ogni pagina modello qui.
  • Forge registra il piano memoria nella console ("Moving model(s) has taken...") - guardalo una volta per capire cosa fa il cursore GPU Weights.

Risoluzione dei problemi

Checkpoint Flux si carica ma le immagini sono rumore o grigie

Perché succede
Mancano o sono sbagliati text encoder / VAE, o mismatch Low Bits.

Come risolverlo
Spunta ae, clip_l e un file t5xxl sotto VAE / Text Encoder; imposta Diffusion in Low Bits per corrispondere al checkpoint.

AttributeError: NoneType ... cambiando modello

Perché succede
Selettore UI in modalità sbagliata.

Come risolverlo
Imposta sd, xl o flux per corrispondere al checkpoint, poi ricarica il modello.

Memoria esaurita anche se A1111 ha fatto girare lo stesso modello SDXL

Perché succede
GPU Weights impostato vicino alla VRAM totale, senza spazio per attivazioni.

Come risolverlo
Abbassa GPU Weights di 1000 MB alla volta; 2 GB liberi è il punto giusto.

Generazione molto lenta (minuti per immagine)

Perché succede
Pesi modello spostati su CPU perché GPU Weights troppo basso, o Metodo Swap su Queue con driver vecchio.

Come risolverlo
Alza GPU Weights finché non fallisce; prova Async / Shared swap.

ControlNet di A1111 crasha all’avvio

Perché succede
L’estensione A1111 aggancia il vecchio backend.

Come risolverlo
Eliminala da extensions; usa la scheda ControlNet integrata e i suoi modelli in models/ControlNet.

LoRA non fa nulla con Flux

Perché succede
Un LoRA SDXL, o peso troppo basso, o manca la parola trigger.

Come risolverlo
Usa un LoRA della famiglia Flux (lo dice la pagina modello), peso 0.8, includi la parola trigger.

Prompt negativo ignorato

Perché succede
Flux a CFG 1 non ha guida negativa di proposito.

Come risolverlo
Alza CFG a 2-3 (più lento e colori cambiano) o descrivi quello che vuoi in positivo.

AD
PirateDiffusion
Nessuna installazione: esegui i modelli IA nel cloud
PirateDiffusion è solo su Telegram ed è pensato per i professionisti: migliaia di modelli, LoRA e workflow tramite comandi in chat, con generazione illimitata a prezzo fisso.

Domande

Forge sostituisce completamente A1111?

Per immagini SD 1.5, SDXL e Flux sì, con meno memoria e backend più veloce. Alcune estensioni di nicchia non sono mai state migrate. Per video e audio serve ComfyUI.

Quale file Flux devo scaricare?

Per 6-8 GB: checkpoint NF4. Per 12 GB: fp8 con encoder separati. Per 24 GB: dev fp16 completo. La pagina famiglia Flux qui elenca i file base e i LoRA.

Posso usare i miei LoRA da Civitai?

Sì, stessa cartella (models/Lora) e stessa sintassi <lora:name:weight>, purché la famiglia LoRA corrisponda al checkpoint.

Perché i miei infotext PNG A1111 danno immagini Flux diverse?

Flux aggiunge il parametro Distilled CFG e gli encoder contano; copia la riga completa delle impostazioni dal PNG e imposta lo stesso file t5.

E se la mia scheda è troppo piccola anche per NF4?

Usa gli stessi modelli ospitati: PirateDiffusion da Telegram o BitVector nel browser. Entrambi appaiono nella casella Run di ogni pagina modello qui.

Link e fonti

Modelli di questa guida

Scritto da
Captain

Guide correlate

Errori e soluzioni
Errori e soluzioni di Automatic1111 (Stable Diffusion WebUI)
Soluzioni per gli errori di Stable Diffusion WebUI che bloccano la maggior parte delle installazioni: "Torch non riesce a usare la GPU", NansException, CUDA out of memory, "Couldn't install torch", xformers, "Stable diffusion model failed to load", estensioni rotte dopo un aggiornamento e problemi specifici di SDXL.
Di Captain
2026-05-14
Errori e soluzioni
Errori di ComfyUI e come risolverli: nodi rossi, modelli mancanti, CUDA out of memory
I messaggi di errore di ComfyUI che si incontrano per primi, cosa significa ognuno e la soluzione che funziona: nodi personalizzati mancanti (box rossi), "Prompt outputs failed validation", CUDA out of memory, tipo di modello sbagliato in un loader, errori di forma mat1 e mat2, deserializzazione header, incompatibilità tra torch e xformers.
Di Captain
2026-05-12
Errori e soluzioni
CUDA memoria esaurita: quanta VRAM serve a ogni modello AI e come farlo entrare
Una tabella della VRAM per SD 1.5, SDXL, Flux, FLUX.2, Qwen-Image, Z-Image, Wan 2.2 e HunyuanVideo, e le tecniche per far entrare un modello: quantizzazione fp8 e GGUF, offload su CPU, VAE a tiles, limiti di risoluzione e frame, e quando smettere di lottare e usarlo in hosting.
Di Captain
2026-05-18
Prompting
Guida al prompting di FLUX.2: prompt in linguaggio naturale, multi-riferimento, editing e LoRA
Come ottenere i risultati per cui FLUX.2 dev è noto: prompt a paragrafi con soggetto, scena, luce e obiettivo, testo esatto tra virgolette, fino a diverse immagini di riferimento per prodotti, persone e stili, modifiche in stile istruzione, le impostazioni di guida e passi che contano, e come i LoRA di FLUX.2 differiscono da quelli di Flux dev.
Di Captain
2026-05-28

Altre guide

Modelli
FLUX.1 Dev: come usarlo, impostazioni migliori e idee creative
Una guida pratica a FLUX.1 Dev di Black Forest Labs: come scrivere i prompt in linguaggio naturale, impostazioni di guida e passi, stacking di LoRA, rendering del testo e idee per prompt che sfruttano i suoi punti di forza.
Di Captain
2026-09-30
Modelli
Stable Diffusion XL 1.0: prompt, impostazioni e cosa fa ancora meglio
Come ottenere il massimo dal modello base ufficiale SDXL 1.0: risoluzioni native, impostazioni di CFG e sampler, il refiner, prompt negativi e idee per stili in cui SDXL brilla ancora.
Di Captain
2026-10-01
Modelli
Stable Diffusion 1.5: il modello classico, usato nel modo giusto
Stable Diffusion 1.5 vale ancora la pena conoscerlo: la risoluzione giusta, CFG e sampler, come usare la sua enorme libreria di LoRA e embedding, e idee creative per prompt adatte a un modello a 512 pixel.
Di Captain
2026-10-02
Modelli
FLUX.2 Dev: come usare il modello più recente di Black Forest Labs
FLUX.2 Dev supporta prompt più lunghi, testo migliore, realismo più forte e modifica con riferimenti multipli. Questa guida spiega il flusso turbo, le impostazioni di guida e risoluzione, la struttura del prompt e idee che sfruttano le sue nuove potenzialità.
Di Captain
2026-10-03
Modelli
Qwen-Image: prompt lunghi, testo perfetto e poster bilingue
Qwen-Image è il modello da usare quando le parole nell'immagine contano. Scopri come scrivere prompt descrittivi lunghi, riprodurre testo in inglese e cinese con precisione, impostare CFG e passi, e esplorare idee creative con layout complessi.
Di Captain
2026-09-29
Modelli
SDXL-Lightning: generazione in quattro passaggi su qualsiasi checkpoint SDXL
Lo LoRA SDXL-Lightning di ByteDance trasforma un rendering SDXL da 30 passaggi in uno da 4. Scopri il numero di passaggi, il CFG da usare, il sampler e come combinarlo con i tuoi checkpoint e LoRA di stile preferiti.
Di Captain
2026-09-30