Erros e correções do Stable Diffusion WebUI Forge (Flux, SDXL, baixa VRAM)
Tema: Erros e soluções
Por Captain
Publicado em 2026-05-16
Problemas específicos do Forge e suas soluções: Flux que não carrega ou gera ruído, a troca do tipo de UI (sd / xl / flux), o controle deslizante "GPU Weights" e erros de falta de memória, encoders de texto e VAE ausentes para Flux, falhas no ControlNet e extensões, e as diferenças em relação ao Automatic1111 que confundem as pessoas.
Visão geral
Forge é um fork do lllyasviel do
Automatic1111
WebUI, construído em um backend novo com gerenciamento agressivo de memória. Ele roda
Flux dev
em placas de 6 a 8 GB e
SDXL
em 4 GB, por isso muita gente migra para ele. O preço são erros que usuários do A1111 não viram: um modo de UI que precisa combinar com o modelo, um controle deslizante GPU Weights que decide se o modelo cabe, e arquivos separados para
Flux
(modelo de difusão, dois encoders de texto, VAE) que precisam estar todos presentes.
A regra que resolve metade dos problemas do Forge: o seletor de UI no canto superior esquerdo (sd, xl, flux, all) tem que combinar com o
checkpoint
, e para Flux a caixa VAE / Text Encoder deve listar ae.safetensors, clip_l.safetensors e um arquivo t5xxl. A outra metade é o valor de GPU Weights: muito alto dá falta de memória, muito baixo deixa a geração lenta mas funciona.
Alternativas hospedadas para o que ainda não cabe:
PirateDiffusion
serve Flux, SDXL e famílias mais novas via fluxos hospedados no Telegram, e
BitVector
roda os mesmos modelos numa web app e no Discord. As páginas dos modelos neste site têm uma caixa Run para ambos.
Referência
Nome | Tipo | O que é |
|---|---|---|
UI selector (sd / xl / flux / all) | setting | Escolhe o modo do backend e quais menus aparecem. Um checkpoint Flux em "xl" dá erro de forma ou NoneType. |
GPU Weights (MB) | setting | Quanto do modelo fica na GPU. Deixe cerca de 1,5 a 2 GB livres para ativações: numa placa de 12 GB, ajuste para 9000 a 10000 para Flux. |
Swap Method / Swap Location | setting | Queue vs Async, CPU vs Shared. Async com Shared é mais rápido no Windows com driver moderno; Queue com CPU é a opção segura. |
Diffusion in Low Bits | setting | Automatic escolhe fp8 para Flux. Defina bnb-nf4 para checkpoints NF4 ou fp8_e4m3fn para os fp8; erro aqui gera ruído. |
VAE / Text Encoder | setting | Para Flux selecione ae.safetensors, clip_l.safetensors e t5xxl_fp16 ou t5xxl_fp8_e4m3fn. Sem t5, as imagens ficam em branco ou lixo. |
models/text_encoder, models/VAE | folders | Onde o Forge procura encoders e VAE do Flux. Usuários do A1111 costumam colocar por engano na pasta do checkpoint. |
CUDA out of memory / Allocation on device | error | GPU Weights muito alto para a resolução e batch. Diminua em passos de 1000 MB. |
NoneType has no attribute ... in forge_loader | error | |
Extension errors on start | error | Extensões do A1111 que mexem no backend antigo (alguns forks do ControlNet , versões do Adetailer, Dynamic Prompts) quebram no Forge. Use as versões compatíveis com Forge. |
AD

Sem instalação: rode modelos de IA na nuvem
BitVector Prism é a forma mais fácil de começar: escolha um modelo, digite um prompt e gere em um app web limpo, sem configurar nada. O BitVector também está disponível no Discord e na web (SpyGlass).
Passo a passo
- Instale pelo pacote oficial one-click ou git clone; rode update.bat uma vez, depois run.bat. Forge já traz seu próprio Python e torch.
- Coloque os arquivos nas pastas do Forge: checkpoints e modelos de difusão Flux em models/Stable-diffusion, encoders de texto em models/text_encoder, VAEs em models/VAE, LoRAs em models/Lora. Forge também lê a árvore de pastas do A1111 via webui-user.bat --ckpt-dir e --lora-dir.
- Mude o seletor de UI para a família do modelo que você carregar. Para Flux dev fp8 selecione flux, depois em VAE / Text Encoder marque ae.safetensors, clip_l.safetensors e t5xxl_fp8_e4m3fn.safetensors.
- Ajuste GPU Weights: total deVRAMem MB menos uns 2000 para imagens 1024, menos 3000 se usar hires fix ou ControlNet. Gere uma vez; se der erro de falta de memória, diminua 1000 e tente de novo.
- Deixe Diffusion in Low Bits em Automatic a menos que tenha baixado um checkpoint NF4 (ai bnb-nf4). As páginas dos modelos Flux aqui indicam a quantização na lista de arquivos.
- Configurações do Flux que são diferentes do SDXL: DistilledCFGScale 3.5 e CFG 1, 20 a 28 passos, Euler com agenda Simple. Prompts negativos são ignorados no CFG 1.
- Se extensões falharem, comece com --disable-all-extensions, depois ative as versões mantidas pelo Forge (ControlNet embutido, FreeU embutido e Kohya HRFix já estão lá).
- Para vídeo ou modelos além do Forge (Wan,Qwen-Image,HunyuanVideo), useComfyUIou rode hospedado no BitVector ou PirateDiffusion; Forge é UI só para imagem.
Exemplos
webui-user.bat compartilhando uma pasta de modelo A1111
set COMMANDLINE_ARGS=--ckpt-dir D:\sd\models\Stable-diffusion --lora-dir D:\sd\models\Lora --vae-dir D:\sd\models\VAE
Configurações Flux dev fp8
UI: flux | Checkpoint: flux1-dev-fp8.safetensors | VAE/Text Encoder: ae.safetensors, clip_l.safetensors, t5xxl_fp8_e4m3fn.safetensors
Steps 24 | Sampler Euler | Schedule Simple | CFG 1 | Distilled CFG 3.5 | 1024x1024 | GPU Weights 9500 (12 GB card)
Dicas
- Forge já traz ControlNet, FreeU, Kohya HRFix, SAG e mais embutidos; remova as versões do A1111 da pasta extensions antes de migrar.
- O checkpoint NF4 Flux (uns 6,8 GB com encoders embutidos) é o Flux mais simples para placas de 8 GB; a versão fp8 com encoders separados dá detalhes um pouco melhores em 12 GB.
- Defina Swap Method para Async e Swap Location para Shared, gere, e volte para Queue/CPU se o driver travar. Async pode dobrar a velocidade em placas de 8 GB.
- A seed, sampler e CFG de um PNG do A1111 reproduzem no Forge paraSD 1.5e SDXL; imagens Flux precisam do valor Distilled CFG também.
- Mantenha pesos LoRA para Flux entre 0.6 e 0.9; LoRAs Flux saturam mais rápido que os SDXL. Palavras de gatilho estão em cada página de modelo aqui.
- Forge mostra o plano de memória no console ("Moving model(s) has taken...") - veja uma vez para entender o que o controle GPU Weights faz.
Solução de problemas
Checkpoint Flux carrega mas imagens ficam com ruído ou cinza
Por que acontece
Encoders de texto / VAE faltando ou errados, ou incompatibilidade em Low Bits.
Como corrigir
Marque ae, clip_l e um arquivo t5xxl em VAE / Text Encoder; ajuste Diffusion in Low Bits para combinar com o checkpoint.
AttributeError: NoneType ... ao trocar modelos
Por que acontece
Seletor de UI no modo errado.
Como corrigir
Coloque sd, xl ou flux para combinar com o checkpoint, depois selecione o modelo de novo.
Falta de memória mesmo com A1111 rodando o mesmo modelo SDXL
Por que acontece
GPU Weights está perto do total de VRAM, sem espaço para ativações.
Como corrigir
Diminua GPU Weights em 1000 MB por vez; 2 GB livres é o ideal.
Geração muito lenta (minutos por imagem)
Por que acontece
Pesos do modelo trocados para CPU porque GPU Weights está muito baixo, ou Swap Method em Queue com driver antigo.
Como corrigir
Aumente GPU Weights até pouco antes do erro; tente swap Async / Shared.
ControlNet do A1111 trava na inicialização
Por que acontece
Extensão A1111 mexe no backend antigo.
Como corrigir
Apague ela da pasta extensions; use a aba ControlNet embutida e os modelos em models/ControlNet.
LoRA não funciona com Flux
Por que acontece
LoRA SDXL, peso muito baixo, ou falta palavra de gatilho.
Como corrigir
Use LoRA da família Flux (indicado na página do modelo), peso 0.8, inclua a palavra de gatilho.
Prompt negativo é ignorado
Por que acontece
Flux no CFG 1 não tem orientação negativa por design.
Como corrigir
Aumente CFG para 2 a 3 (mais lento, cores mudam) ou descreva o que quer positivamente.
AD

Sem instalação: rode modelos de IA na nuvem
O PirateDiffusion é exclusivo do Telegram e feito para profissionais: milhares de modelos, LoRAs e workflows por comandos de chat, com geração ilimitada a preço fixo.
Perguntas
Forge substitui o A1111 completamente?
Para SD 1.5, SDXL e imagens Flux, sim, com menos memória e backend mais rápido. Algumas extensões específicas nunca migraram. Modelos de vídeo e áudio precisam do ComfyUI.
Qual arquivo Flux devo baixar?
Para 6 a 8 GB: checkpoint NF4. Para 12 GB: fp8 com encoders separados. Para 24 GB: dev completo fp16. A página da família Flux aqui lista os arquivos base e os LoRAs.
Posso usar meus LoRAs do Civitai?
Sim, mesma pasta (models/Lora) e mesma sintaxe <lora:name:weight>, desde que a família do LoRA combine com o checkpoint.
Por que meus infotexts PNG do A1111 geram imagens Flux diferentes?
Flux adiciona o parâmetro Distilled CFG e os encoders importam; copie a linha completa de configurações do PNG e use o mesmo arquivo t5.
E se minha placa for pequena demais até para NF4?
Use os mesmos modelos hospedados: PirateDiffusion no Telegram, ou BitVector no navegador. Ambos aparecem na caixa Run em cada página de modelo aqui.
Links e fontes
- Forge on GitHub
- Forge Flux discussion and settings
- Flux family page on ModelTrends.ai
- Hosted Flux on PirateDiffusion
- BitVector web app
Modelos deste guia
Escrito por
Captain
Guias relacionados
Erros e soluções
Erros e correções do Automatic1111 (Stable Diffusion WebUI)
Correções para os erros do Stable Diffusion WebUI que travam a maioria das instalações: "Torch não consegue usar GPU", NansException, CUDA sem memória, "Não foi possível instalar torch", xformers, "Falha ao carregar modelo Stable Diffusion", extensões quebradas após atualização e problemas específicos do SDXL.
Por Captain
2026-05-14
Erros e soluções
Erros do ComfyUI e como consertar: nós vermelhos, modelos faltando, CUDA sem memória
As mensagens de erro do ComfyUI que as pessoas veem primeiro, o que cada uma significa e a solução que funciona: nós customizados faltando (caixas vermelhas), "Prompt outputs failed validation", CUDA sem memória, tipo errado de modelo em um loader, erros de forma mat1 e mat2, desserialização de cabeçalho, incompatibilidades entre torch e xformers.
Por Captain
2026-05-12
Erros e soluções
CUDA sem memória: quanta VRAM cada modelo de IA precisa e como fazer caber
Uma tabela de VRAM para SD 1.5, SDXL, Flux, FLUX.2, Qwen-Image, Z-Image, Wan 2.2 e HunyuanVideo, e as técnicas que fazem um modelo caber: quantização fp8 e GGUF, offload para CPU, VAE em blocos, limites de resolução e quadros, e quando parar de tentar e usar hospedagem.
Por Captain
2026-05-18
Prompting
Guia de prompting FLUX.2: prompts em linguagem natural, múltiplas referências, edição e LoRAs
Como usar o FLUX.2 dev para conseguir os resultados conhecidos: prompts em parágrafos com sujeito, cena, luz e lente, texto exato entre aspas, várias imagens de referência para produtos, pessoas e estilos, edições no estilo instrução, as configurações de guidance e steps que importam, e como os LoRAs do FLUX.2 diferem dos LoRAs do Flux dev.
Por Captain
2026-05-28
Mais guias
Modelos
FLUX.1 Dev: como criar prompts, melhores configurações e ideias criativas
Um guia prático para FLUX.1 Dev da Black Forest Labs: como criar prompts em linguagem natural, configurações de orientação e passos, empilhamento de LoRA, renderização de texto e ideias de prompt que aproveitam seus pontos fortes.
Por Captain
2026-09-30
Modelos
Stable Diffusion XL 1.0: prompts, configurações e no que ele ainda é melhor
Como tirar o máximo proveito do modelo base oficial SDXL 1.0: resoluções nativas, configurações de CFG e sampler, o refinador, prompts negativos e ideias de estilos onde o SDXL ainda se destaca.
Por Captain
2026-10-01
Modelos
Stable Diffusion 1.5: o modelo clássico, usado do jeito certo
Stable Diffusion 1.5 ainda vale a pena conhecer: a resolução certa, CFG e sampler, como usar sua enorme biblioteca de LoRAs e embeddings, e ideias criativas de prompt para um modelo de 512 pixels.
Por Captain
2026-10-02
Modelos
FLUX.2 Dev: criando prompts para o modelo mais novo da Black Forest Labs
FLUX.2 Dev traz prompts maiores, texto melhor, realismo mais forte e edição com múltiplas referências. Este guia cobre o fluxo turbo, configurações de orientação e resolução, estrutura do prompt e ideias que aproveitam suas novas forças.
Por Captain
2026-10-03
Modelos
Qwen-Image: prompts longos, texto perfeito e pôsteres bilíngues
Qwen-Image é o modelo ideal quando as palavras na imagem importam. Aprenda a escrever seus prompts longos e descritivos, renderizar texto em inglês e chinês com precisão, ajustar CFG e passos, e explorar ideias criativas com muitos elementos no layout.
Por Captain
2026-09-29
Modelos
SDXL-Lightning: geração em quatro passos em qualquer checkpoint SDXL
O LoRA SDXL-Lightning da ByteDance transforma uma renderização SDXL de 30 passos em uma de 4 passos. Saiba a quantidade de passos, o CFG que você deve usar, o sampler e como combinar com seus checkpoints e LoRAs de estilo favoritos.
Por Captain
2026-09-30

Model
Trends
.ai
© ModelTrends.ai
|
Feito no Japão
|
© 2026