Começando com geração de imagens por IA: sua primeira imagem em dez minutos
Tema: Serviços na nuvem
Por Captain
Publicado em 2025-08-14
Visão geral
Geração de imagem por IA transforma uma frase em uma imagem. Você digita uma descrição (o prompt), um modelo que aprendeu com milhões de imagens legendadas transforma um ruído aleatório em algo que combina com a descrição, e em poucos segundos você tem uma imagem. Todo o resto nesse hobby,
LoRAs
,
samplers
,
ControlNet
,
upscalers
, é só um refinamento desse ciclo: descrever, gerar, olhar, ajustar.
O modelo é a parte que mais importa. Modelos diferentes têm pontos fortes diferentes:
SDXL
e seus ajustes para anime desenham ilustrações e personagens,
Flux
e
Z-Image
seguem prompts longos e geram texto legível,
Wan
e
LTX
fazem vídeo. ModelTrends.ai existe para mostrar quais modelos as pessoas estão usando de verdade essa semana, assim você não precisa adivinhar. Cada página de modelo mostra imagens de exemplo com o prompt e as configurações exatas que geraram elas, que é a forma mais rápida de aprender.
Você não precisa de um PC gamer para começar. A forma mais rápida de fazer sua primeira imagem é num serviço na nuvem onde os modelos já estão instalados: um app web como
BitVector
, onde você escolhe um modelo e digita, ou o chat bot
PirateDiffusion
no Telegram, onde você manda um comando. Rodar modelos na sua própria placa de vídeo vem depois, quando você já souber quais modelos gosta e se quer gastar com hardware.
Referência
Nome | Tipo | O que é |
|---|---|---|
Prompt | text | O que você quer ver. Primeiro o assunto, depois o cenário, depois estilo e iluminação. Inglês simples funciona nos modelos modernos; listas de palavras-chave funcionam nos mais antigos. |
text | O que você não quer (borrado, dedos extras, marca d'água). Importa no SD 1.5 e SDXL; Flux e outros modelos mais novos geralmente ignoram. | |
Model / checkpoint | choice | O cérebro. Escolha da lista mais popular deste site; a família define o visual e o estilo do prompt. |
Size | pixels | 512x512 para SD 1.5, 1024x1024 para SDXL e Flux. Outras proporções com o mesmo número de pixels funcionam (832x1216 retrato, 1216x832 paisagem). |
Steps | number | Quantas vezes o modelo refina a imagem. 20 a 30 é o normal; mais é mais lento e raramente melhor. |
CFG / guidance | number | O quanto o modelo segue o prompt. 5 a 7 no SDXL, 3.5 no Flux, 1 nos modelos turbo ou lightning. |
Seed | number | O ruído inicial. A mesma seed com as mesmas configurações gera a mesma imagem, assim você pode mudar uma coisa de cada vez. |
choice | A matemática usada para tirar o ruído. Euler ou DPM++ 2M Karras são escolhas seguras; a página do modelo mostra o que os exemplos usaram. |
AD

Faça sua primeira imagem sem instalar nada
BitVector Prism é um app web: escolha um dos modelos deste site, digite o prompt do exemplo acima e gere. Nada para baixar, nada para configurar, funciona no celular.
Passo a passo
- Abra o navegador de modelos neste site e ordene por popularidade. Escolha um modelo base (checkpoint, não um LoRA) da família SDXL ou Flux; ajustes SDXL como DreamShaper XL ou Juggernaut XL são mais fáceis para a primeira tentativa.
- Leia a página do modelo: veja três ou quatro imagens de exemplo e seus prompts. Repare no padrão: assunto, cena, iluminação, câmera, palavras de estilo.
- Clique no botão Run na página do modelo. BitVector abre um app web com o modelo já selecionado; PirateDiffusion abre um chat no Telegram onde você digita /render seguido do seu prompt.
- Escreva seu primeiro prompt copiando um exemplo e mudando só o assunto. Mantenha o tamanho, passos e sampler que o exemplo usou.
- Gere quatro imagens, não só uma. O ruído aleatório faz algumas seeds serem melhores que outras; julgar um modelo por uma imagem só é erro.
- Mude uma coisa: adicione uma palavra de iluminação (golden hour, soft studio light), ou uma palavra de câmera (35mm, close-up), e gere de novo. É assim que se aprende a criar prompts.
- Marque com estrela os modelos que gostar com o coração no cartão; a página Favs guarda eles no seu navegador para você voltar sem precisar de conta.
Exemplos
Um primeiro prompt para um modelo de foto SDXL
a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo, shallow depth of field
Negative: blurry, deformed hands, watermark, text | 1216x832 | DPM++ 2M Karras | 28 steps | CFG 6
A mesma ideia no PirateDiffusion (Telegram)
/render <dreamshaper-xl> a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo [[blurry, watermark]] /size:1216x832 /steps:28
Um prompt Flux (sem negativo, orientação menor)
A candid photo of a fisherman mending a fishing net on a weathered pier at dawn. Soft fog over the water, warm low sun from the left, shallow depth of field, 35mm film look.
1216x832 | Euler | 24 steps | guidance 3.5
Dicas
- O modelo é o maior fator, o prompt o segundo, as configurações o terceiro. Quem está começando costuma gastar tempo na ordem errada.
- Prompts curtos e concretos são melhores que longos e vagos. "Uma bicicleta vermelha encostada numa parede branca, luz da manhã, foto 50mm" é melhor que "bela incrível impressionante obra-prima 8k bicicleta".
- Formas retrato para pessoas, formas paisagem para cenas. Quadrado raramente é a melhor forma para algo.
- Salve os prompts que gostar num arquivo de texto. Cada página de modelo aqui mostra o prompt completo sob os exemplos pelo mesmo motivo.
- Modelos de anime e ilustração (Illustrious, Pony, NoobAI) usam prompts no estilo tags; modelos de foto (Flux, Z-Image, ajustes SDXL para foto) usam frases. A página da família explica qual é qual.
- Não baixe nada até ter usado um modelo na nuvem e ter gostado. Checkpoints têm entre 2 e 24 GB cada.
Solução de problemas
Todas as imagens parecem iguais
Por que acontece
A seed está fixa, ou o prompt é uma lista de palavras genéricas de qualidade.
Como corrigir
Coloque a seed como aleatória, tire "masterpiece, 8k, best quality" dos prompts de foto, descreva a cena em vez disso.
Mãos e rostos estão errados
Por que acontece
Rostos e mãos pequenos em baixa resolução, ou um modelo SD 1.5 antigo.
Como corrigir
Use SDXL ou Flux em 1024 pixels, enquadre o assunto maior, ou retoque o rosto depois (veja o guia de
inpainting
).
A imagem ignora metade do prompt
Por que acontece
Muitas ideias num prompt só, ou CFG muito baixo.
Como corrigir
Um assunto, um cenário, um estilo por prompt. Aumente o CFG em 1 no SDXL. Flux e
Qwen
seguem prompts longos muito melhor que SD 1.5.
Texto na imagem está sem sentido
Por que acontece
SD 1.5 e SDXL não soletram direito.
Como corrigir
Demora minutos por imagem no meu laptop
Por que acontece
Sem GPU dedicada, ou placa com menos de 6 GB de memória.
Como corrigir
Gere na nuvem (BitVector, PirateDiffusion) e use o laptop só para ver os resultados.
AD

Milhares de modelos numa janela de chat
PirateDiffusion roda no Telegram: mande /render e um prompt e a imagem volta no chat. Todo modelo e LoRA deste site com botão Run já está instalado lá, por um preço fixo mensal com geração ilimitada.
Perguntas
Preciso pagar para testar isso?
Os parceiros na nuvem indicados nas páginas dos modelos deixam você começar sem instalar nada; ferramentas locais (ComfyUI,
Forge
) são grátis mas precisam de uma placa de vídeo com pelo menos 8 GB de memória para os modelos atuais.
Com qual modelo um iniciante deve começar?
Um ajuste SDXL para ilustração ou um modelo
Flux dev
para fotos. O guia "quais modelos testar primeiro" neste site lista eles com os motivos.
LoRA é um modelo?
LoRA é um complemento que muda um modelo base. Você precisa de um modelo base (checkpoint) primeiro; o LoRA vai por cima. O guia de LoRA explica isso.
Posso fazer vídeo também?
Sim, com Wan,
LTX-2
e
MiniMax H3
entre outros, mas vídeo precisa de muito mais memória localmente. Comece na nuvem; o guia de início em vídeo explica isso.
As imagens são minhas?
As licenças variam por modelo; a página do modelo tem o link para a licença. A maioria dos modelos abertos permite uso pessoal e comercial, algumas licenças só para pesquisa (builds iniciais do Flux dev) não permitem.
Por que meus resultados parecem piores que os exemplos?
Normalmente por tamanho, sampler ou número de passos diferente. Copie as configurações do exemplo exatamente primeiro, depois mude uma coisa de cada vez.
Links e fontes
- Models browser (sort by hot)
- Weekly ranking
- BitVector web app
- PirateDiffusion on Telegram
- SDXL family page
- Flux family page
Modelos deste guia
Escrito por
Captain
Guias relacionados
Modelos
Quais modelos de imagem de IA experimentar primeiro, e por quê: uma lista inicial classificada
Sete modelos para a primeira semana, escolhidos pela facilidade de uso em vez do hype: um fine-tune fotográfico SDXL, um fine-tune de anime, Flux dev, um modelo turbo rápido, um modelo de inpainting, um modelo de vídeo e um upscaler, cada um com a razão, a memória que precisa e o estilo de prompt que espera.
Por Captain
2025-09-10
Prompting
Noções básicas de escrita de prompt para imagens de IA: estrutura, ordem, pesos e os dois dialetos de prompt
Como escrever um prompt que funcione na primeira tentativa: a ordem sujeito-cena-estilo, por que a posição das palavras importa, o dialeto de tags dos modelos SDXL de anime contra o dialeto de frases do Flux e Qwen, pesos de atenção, limites de comprimento do prompt e uma lista de verificação para corrigir um prompt que está sendo ignorado.
Por Captain
2025-10-22
Modelos
Como funcionam os modelos de imagem generativa de IA: difusão, latentes e codificadores de texto explicados de forma simples
Os mecanismos por trás do Stable Diffusion, SDXL, Flux e os modelos de vídeo sem a matemática: o que o ruído tem a ver com isso, por que os modelos funcionam em um espaço latente comprimido, o que o codificador de texto e o VAE fazem, o que os passos e a orientação realmente mudam, e por que os dados de treinamento decidem o que um modelo pode desenhar.
Por Quartermaster
2025-08-28
Modelos
O que é um LoRA e como usar um no ComfyUI, Forge, Automatic1111 e na nuvem
LoRAs explicados para quem quer resultados, não matemática: o que um arquivo LoRA muda, por que ele precisa combinar com a família do modelo base, palavras de gatilho, pesos, empilhar vários LoRAs, a pasta e a sintaxe para cada UI, e como testar um LoRA na nuvem antes de baixar qualquer coisa.
Por Captain
2026-05-20
Serviços na nuvem
PirateDiffusion: rode qualquer modelo pelo Telegram, sem precisar de GPU
Os comandos importantes no bot PirateDiffusion do Telegram: /render com palavras-chave do modelo, ponderação com (( )) e [[ ]], #recipes, /adetailer, upscaling com /highdef e /facelift, /remix, /inpaint, fluxos de trabalho ComfyUI com /wf /run:, e as novas habilidades // que escolhem o modelo pra você.
Por Captain
2026-10-03
Mais guias
Serviços na nuvem
Taxa fixa vs tokens: por que planos ilimitados como Graydient.ai são o melhor custo-benefício para criadores de IA em 2026
Uma comparação de custos ranqueada, com preços verificados em 8 de outubro de 2026, entre planos ilimitados com taxa fixa como Graydient.ai e preços por token e crédito do Midjourney, Leonardo, fal.ai, Replicate, Runway e Kling: quanto realmente custam 1.000 imagens e 1.000 vídeos por mês em cada um, e por que uma taxa fixa para imagens, vídeos, áudio, chat Grok LLM e apps web ilimitados é o melhor custo-benefício para criadores que fazem várias versões.
Por Captain
2026-10-08
Modelos
FLUX.1 Dev: como criar prompts, melhores configurações e ideias criativas
Um guia prático para FLUX.1 Dev da Black Forest Labs: como criar prompts em linguagem natural, configurações de orientação e passos, empilhamento de LoRA, renderização de texto e ideias de prompt que aproveitam seus pontos fortes.
Por Captain
2026-09-30
Modelos
Stable Diffusion XL 1.0: prompts, configurações e no que ele ainda é melhor
Como tirar o máximo proveito do modelo base oficial SDXL 1.0: resoluções nativas, configurações de CFG e sampler, o refinador, prompts negativos e ideias de estilos onde o SDXL ainda se destaca.
Por Captain
2026-10-01
Modelos
Stable Diffusion 1.5: o modelo clássico, usado do jeito certo
Stable Diffusion 1.5 ainda vale a pena conhecer: a resolução certa, CFG e sampler, como usar sua enorme biblioteca de LoRAs e embeddings, e ideias criativas de prompt para um modelo de 512 pixels.
Por Captain
2026-10-02
Modelos
FLUX.2 Dev: criando prompts para o modelo mais novo da Black Forest Labs
FLUX.2 Dev traz prompts maiores, texto melhor, realismo mais forte e edição com múltiplas referências. Este guia cobre o fluxo turbo, configurações de orientação e resolução, estrutura do prompt e ideias que aproveitam suas novas forças.
Por Captain
2026-10-03
Modelos
Qwen-Image: prompts longos, texto perfeito e pôsteres bilíngues
Qwen-Image é o modelo ideal quando as palavras na imagem importam. Aprenda a escrever seus prompts longos e descritivos, renderizar texto em inglês e chinês com precisão, ajustar CFG e passos, e explorar ideias criativas com muitos elementos no layout.
Por Captain
2026-09-29

Model
Trends
.ai
© ModelTrends.ai
|
© 2026
|
Todos os direitos reservados