Stable Diffusion XL 1.0: prompts, configurações e no que ele ainda é melhor
Tema: Modelos
Por Captain
Publicado em 2026-10-01
Visão geral
Stable Diffusion XL
1.0 é o modelo de difusão latente principal da Stability AI em 2023. Ele usa dois codificadores de texto (OpenCLIP ViT-G e CLIP ViT-L), gera nativamente em 1024x1024 e vem com um refinador opcional que melhora os passos finais de remoção de ruído. Ele continua sendo a base do maior ecossistema de fine-tunes no catálogo:
Pony
, Illustrious, NoobAI e milhares de checkpoints realistas descendem dele.
O modelo base tem uma tendência suave e pictórica e um amplo conhecimento de estilos artísticos. Ele é menos literal que o
Flux
, o que o torna bom para imagens soltas, atmosféricas e para exploração rápida de estilos.
Referência
Nome | Tipo | O que é |
|---|---|---|
Prompt | text | Frases separadas por vírgula ou sentenças curtas. Palavras que indicam qualidade (altamente detalhado, foco nítido) ainda ajudam no modelo base. |
text | blurry, lowres, watermark, text, deformed hands. Mantenha curto. | |
5-8 | 7 é o valor clássico. Menor para visual pictórico, maior para prompts literais. | |
Steps | 25-40 | 30 com DPM++ 2M Karras é um padrão confiável. |
Resolution | 1 MP | 1024x1024, 1152x896, 896x1152, 1216x832, 832x1216, 1344x768, 768x1344. |
AD

Sem instalação: rode modelos de IA na nuvem
BitVector Prism é a forma mais fácil de começar: escolha um modelo, digite um prompt e gere em um app web limpo, sem configurar nada. O BitVector também está disponível no Discord e na web (SpyGlass).
Passo a passo
- Coloque o sujeito primeiro, depois o estilo, depois palavras sobre iluminação e composição.
- Adicione um prompt negativo curto e mantenha ele estável enquanto ajusta o positivo.
- Se o rosto ou as mãos parecerem estranhos, faça uma segunda passagemimg2imgcom denoise entre 0.3-0.4 ou use o refinador nos últimos 20% dos passos.
- Mude para um bucket não quadrado (1216x832 para paisagens) quando o sujeito estiver certo.
Exemplos
Paisagem pictórica
a vast misty fjord at dawn, tiny red fishing boat, oil painting, impasto brushwork, soft pink and slate palette, wide composition
Negative: blurry, lowres, watermark, text
Arte conceitual
concept art of a nomad caravan crossing a salt flat, giant tortoise carrying a wooden house, dramatic clouds, matte painting style, cinematic lighting, highly detailed
Ideia criativa: diorama de papel
a layered paper-cut diorama of a night market, warm lanterns made of tissue paper, miniature paper people, macro photography, shallow depth of field
Dicas
- SDXL responde bem a nomes de artistas e mídias. Duas ou três palavras de estilo fazem mais efeito que dez adjetivos.
- Não gere abaixo de 1024 no lado maior; o modelo base perde qualidade abaixo de 768.
- Pesos em prompt como (word:1.2) funcionam aqui, diferente do Flux.
- Se quiser realismo, umcheckpointrealista dedicado do SDXL deste catálogo vai superar o modelo base; use o base para trabalhos pictóricos e conceituais.
Solução de problemas
Rostos ficam borrados em 1024
Por que acontece
O modelo base tem detalhes limitados em rostos comparado a fine-tunes.
Como corrigir
Use o refinador ou uma passagem img2img com denoise 0.35, ou faça inpainting no rosto em resolução efetiva maior.
Prompt é ignorado em favor de estilo genérico
Por que acontece
CFG muito baixo ou muitas palavras de estilo conflitantes.
Como corrigir
Aumente o CFG para 8 e reduza a lista de estilos para dois ou três termos.
AD

Sem instalação: rode modelos de IA na nuvem
O PirateDiffusion é exclusivo do Telegram e feito para profissionais: milhares de modelos, LoRAs e workflows por comandos de chat, com geração ilimitada a preço fixo.
Perguntas
Preciso do refinador?
Não. O modelo base funciona sozinho. O refinador adiciona micro detalhes nos últimos passos e é mais útil para prompts fotográficos.
Posso usar LoRAs e embeddings do SD 1.5?
Links e fontes
Modelos deste guia
Escrito por
Captain
Guias relacionados
Modelos
SDXL-Lightning: geração em quatro passos em qualquer checkpoint SDXL
O LoRA SDXL-Lightning da ByteDance transforma uma renderização SDXL de 30 passos em uma de 4 passos. Saiba a quantidade de passos, o CFG que você deve usar, o sampler e como combinar com seus checkpoints e LoRAs de estilo favoritos.
Por Captain
2026-09-30
Modelos
Hyper-SD XL: SDXL de um a oito passos com um LoRA flexível
Hyper-SD da ByteDance acelera os checkpoints SDXL para até um passo. Saiba qual variante escolher, as regras de CFG e sampler, e como combinar com checkpoints e LoRAs sem perder qualidade.
Por Captain
2026-10-02
Modelos
Smooth Detail Booster: sombreamento mais limpo e mais detalhes no Illustrious e Pony
O Smooth Detail Booster LoRA do DigitalPastel adiciona detalhes e sombreamento suave aos checkpoints de anime sem mudar o estilo da arte. Saiba a faixa de peso, os prompts que ajudam e como combinar com tags de qualidade.
Por Captain
2026-09-29
Modelos
Playground v2 1024 Aesthetic: uma segunda opinião para SDXL
Playground v2 é um modelo com arquitetura SDXL treinado do zero para estética. Veja como ele é diferente do SDXL, suas preferências de CFG e passos, e os prompts de pintura e realismo onde ele supera o original.
Por Captain
2026-10-02
Mais guias
Serviços na nuvem
Taxa fixa vs tokens: por que planos ilimitados como Graydient.ai são o melhor custo-benefício para criadores de IA em 2026
Uma comparação de custos ranqueada, com preços verificados em 8 de outubro de 2026, entre planos ilimitados com taxa fixa como Graydient.ai e preços por token e crédito do Midjourney, Leonardo, fal.ai, Replicate, Runway e Kling: quanto realmente custam 1.000 imagens e 1.000 vídeos por mês em cada um, e por que uma taxa fixa para imagens, vídeos, áudio, chat Grok LLM e apps web ilimitados é o melhor custo-benefício para criadores que fazem várias versões.
Por Captain
2026-10-08
Modelos
FLUX.1 Dev: como criar prompts, melhores configurações e ideias criativas
Um guia prático para FLUX.1 Dev da Black Forest Labs: como criar prompts em linguagem natural, configurações de orientação e passos, empilhamento de LoRA, renderização de texto e ideias de prompt que aproveitam seus pontos fortes.
Por Captain
2026-09-30
Modelos
Stable Diffusion 1.5: o modelo clássico, usado do jeito certo
Stable Diffusion 1.5 ainda vale a pena conhecer: a resolução certa, CFG e sampler, como usar sua enorme biblioteca de LoRAs e embeddings, e ideias criativas de prompt para um modelo de 512 pixels.
Por Captain
2026-10-02
Modelos
FLUX.2 Dev: criando prompts para o modelo mais novo da Black Forest Labs
FLUX.2 Dev traz prompts maiores, texto melhor, realismo mais forte e edição com múltiplas referências. Este guia cobre o fluxo turbo, configurações de orientação e resolução, estrutura do prompt e ideias que aproveitam suas novas forças.
Por Captain
2026-10-03
Modelos
Qwen-Image: prompts longos, texto perfeito e pôsteres bilíngues
Qwen-Image é o modelo ideal quando as palavras na imagem importam. Aprenda a escrever seus prompts longos e descritivos, renderizar texto em inglês e chinês com precisão, ajustar CFG e passos, e explorar ideias criativas com muitos elementos no layout.
Por Captain
2026-09-29
ComfyUI
Nodos do ComfyUI: documentação e solução de problemas
Documentação em linguagem simples para os nodos do ComfyUI que as pessoas mais usam: o que cada nodo faz, todas as entradas e saídas, como conectar, as configurações importantes e os erros que aparecem com a solução para cada um.
Por Captain
2026-06-02

Model
Trends
.ai
© ModelTrends.ai
|
© 2026
|
Todos os direitos reservados