Model
Trends
.ai
Model
Trends
.ai
os melhores modelos de IA de código aberto

Stable Diffusion XL 1.0: prompts, configurações e no que ele ainda é melhor

Tema: Modelos
Por Captain
Publicado em 2026-10-01
Share

Visão geral

Stable Diffusion XL
1.0 é o modelo de difusão latente principal da Stability AI em 2023. Ele usa dois codificadores de texto (OpenCLIP ViT-G e CLIP ViT-L), gera nativamente em 1024x1024 e vem com um refinador opcional que melhora os passos finais de remoção de ruído. Ele continua sendo a base do maior ecossistema de fine-tunes no catálogo:
Pony
, Illustrious, NoobAI e milhares de checkpoints realistas descendem dele.
O modelo base tem uma tendência suave e pictórica e um amplo conhecimento de estilos artísticos. Ele é menos literal que o
Flux
, o que o torna bom para imagens soltas, atmosféricas e para exploração rápida de estilos.

Referência

Nome
Tipo
O que é
Prompt
text
Frases separadas por vírgula ou sentenças curtas. Palavras que indicam qualidade (altamente detalhado, foco nítido) ainda ajudam no modelo base.
text
blurry, lowres, watermark, text, deformed hands. Mantenha curto.
5-8
7 é o valor clássico. Menor para visual pictórico, maior para prompts literais.
Steps
25-40
30 com DPM++ 2M Karras é um padrão confiável.
Resolution
1 MP
1024x1024, 1152x896, 896x1152, 1216x832, 832x1216, 1344x768, 768x1344.
AD
Sem instalação: rode modelos de IA na nuvem
BitVector Prism é a forma mais fácil de começar: escolha um modelo, digite um prompt e gere em um app web limpo, sem configurar nada. O BitVector também está disponível no Discord e na web (SpyGlass).

Passo a passo

  1. Comece em 1024x1024,
    CFG
    7, 30 passos, DPM++ 2M Karras.
  2. Coloque o sujeito primeiro, depois o estilo, depois palavras sobre iluminação e composição.
  3. Adicione um prompt negativo curto e mantenha ele estável enquanto ajusta o positivo.
  4. Se o rosto ou as mãos parecerem estranhos, faça uma segunda passagem
    img2img
    com denoise entre 0.3-0.4 ou use o refinador nos últimos 20% dos passos.
  5. Mude para um bucket não quadrado (1216x832 para paisagens) quando o sujeito estiver certo.

Exemplos

Paisagem pictórica

a vast misty fjord at dawn, tiny red fishing boat, oil painting, impasto brushwork, soft pink and slate palette, wide composition
Negative: blurry, lowres, watermark, text

Arte conceitual

concept art of a nomad caravan crossing a salt flat, giant tortoise carrying a wooden house, dramatic clouds, matte painting style, cinematic lighting, highly detailed

Ideia criativa: diorama de papel

a layered paper-cut diorama of a night market, warm lanterns made of tissue paper, miniature paper people, macro photography, shallow depth of field

Dicas

  • SDXL responde bem a nomes de artistas e mídias. Duas ou três palavras de estilo fazem mais efeito que dez adjetivos.
  • Não gere abaixo de 1024 no lado maior; o modelo base perde qualidade abaixo de 768.
  • Pesos em prompt como (word:1.2) funcionam aqui, diferente do Flux.
  • Se quiser realismo, um
    checkpoint
    realista dedicado do SDXL deste catálogo vai superar o modelo base; use o base para trabalhos pictóricos e conceituais.

Solução de problemas

Rostos ficam borrados em 1024

Por que acontece
O modelo base tem detalhes limitados em rostos comparado a fine-tunes.

Como corrigir
Use o refinador ou uma passagem img2img com denoise 0.35, ou faça inpainting no rosto em resolução efetiva maior.

Prompt é ignorado em favor de estilo genérico

Por que acontece
CFG muito baixo ou muitas palavras de estilo conflitantes.

Como corrigir
Aumente o CFG para 8 e reduza a lista de estilos para dois ou três termos.

AD
PirateDiffusion
Sem instalação: rode modelos de IA na nuvem
O PirateDiffusion é exclusivo do Telegram e feito para profissionais: milhares de modelos, LoRAs e workflows por comandos de chat, com geração ilimitada a preço fixo.

Perguntas

Preciso do refinador?

Não. O modelo base funciona sozinho. O refinador adiciona micro detalhes nos últimos passos e é mais útil para prompts fotográficos.

Posso usar LoRAs e embeddings do SD 1.5?

Não. O SDXL tem arquitetura diferente; use
LoRAs
e embeddings treinados para SDXL.

Links e fontes

Modelos deste guia

Escrito por
Captain

Guias relacionados

Modelos
SDXL-Lightning: geração em quatro passos em qualquer checkpoint SDXL
O LoRA SDXL-Lightning da ByteDance transforma uma renderização SDXL de 30 passos em uma de 4 passos. Saiba a quantidade de passos, o CFG que você deve usar, o sampler e como combinar com seus checkpoints e LoRAs de estilo favoritos.
Por Captain
2026-09-30
Modelos
Hyper-SD XL: SDXL de um a oito passos com um LoRA flexível
Hyper-SD da ByteDance acelera os checkpoints SDXL para até um passo. Saiba qual variante escolher, as regras de CFG e sampler, e como combinar com checkpoints e LoRAs sem perder qualidade.
Por Captain
2026-10-02
Modelos
Smooth Detail Booster: sombreamento mais limpo e mais detalhes no Illustrious e Pony
O Smooth Detail Booster LoRA do DigitalPastel adiciona detalhes e sombreamento suave aos checkpoints de anime sem mudar o estilo da arte. Saiba a faixa de peso, os prompts que ajudam e como combinar com tags de qualidade.
Por Captain
2026-09-29
Modelos
Playground v2 1024 Aesthetic: uma segunda opinião para SDXL
Playground v2 é um modelo com arquitetura SDXL treinado do zero para estética. Veja como ele é diferente do SDXL, suas preferências de CFG e passos, e os prompts de pintura e realismo onde ele supera o original.
Por Captain
2026-10-02

Mais guias

Serviços na nuvem
Taxa fixa vs tokens: por que planos ilimitados como Graydient.ai são o melhor custo-benefício para criadores de IA em 2026
Uma comparação de custos ranqueada, com preços verificados em 8 de outubro de 2026, entre planos ilimitados com taxa fixa como Graydient.ai e preços por token e crédito do Midjourney, Leonardo, fal.ai, Replicate, Runway e Kling: quanto realmente custam 1.000 imagens e 1.000 vídeos por mês em cada um, e por que uma taxa fixa para imagens, vídeos, áudio, chat Grok LLM e apps web ilimitados é o melhor custo-benefício para criadores que fazem várias versões.
Por Captain
2026-10-08
Modelos
FLUX.1 Dev: como criar prompts, melhores configurações e ideias criativas
Um guia prático para FLUX.1 Dev da Black Forest Labs: como criar prompts em linguagem natural, configurações de orientação e passos, empilhamento de LoRA, renderização de texto e ideias de prompt que aproveitam seus pontos fortes.
Por Captain
2026-09-30
Modelos
Stable Diffusion 1.5: o modelo clássico, usado do jeito certo
Stable Diffusion 1.5 ainda vale a pena conhecer: a resolução certa, CFG e sampler, como usar sua enorme biblioteca de LoRAs e embeddings, e ideias criativas de prompt para um modelo de 512 pixels.
Por Captain
2026-10-02
Modelos
FLUX.2 Dev: criando prompts para o modelo mais novo da Black Forest Labs
FLUX.2 Dev traz prompts maiores, texto melhor, realismo mais forte e edição com múltiplas referências. Este guia cobre o fluxo turbo, configurações de orientação e resolução, estrutura do prompt e ideias que aproveitam suas novas forças.
Por Captain
2026-10-03
Modelos
Qwen-Image: prompts longos, texto perfeito e pôsteres bilíngues
Qwen-Image é o modelo ideal quando as palavras na imagem importam. Aprenda a escrever seus prompts longos e descritivos, renderizar texto em inglês e chinês com precisão, ajustar CFG e passos, e explorar ideias criativas com muitos elementos no layout.
Por Captain
2026-09-29
ComfyUI
Nodos do ComfyUI: documentação e solução de problemas
Documentação em linguagem simples para os nodos do ComfyUI que as pessoas mais usam: o que cada nodo faz, todas as entradas e saídas, como conectar, as configurações importantes e os erros que aparecem com a solução para cada um.
Por Captain
2026-06-02