Model
Trends
.ai
Model
Trends
.ai
los mejores modelos de IA de código abierto

Primeros pasos con la generación de imágenes por IA: tu primera imagen en diez minutos

Tema: Servicios en la nube
Por Captain
Publicado el 2025-08-14
Una introducción sencilla para principiantes totales: qué es un modelo, las tres formas de usar uno (app web, chat bot, tu propio PC), cómo escribir un primer prompt, qué significan los ajustes y cómo distinguir un buen resultado de uno por suerte.

Resumen

La generación de imágenes por IA convierte una frase en una imagen. Escribes una descripción (el prompt), un modelo que ha aprendido de millones de imágenes con texto convierte ruido aleatorio en algo que coincide con la descripción, y en segundos tienes una imagen. Todo lo demás en este hobby,
LoRAs
,
samplers
,
ControlNet
,
upscalers
, es un refinamiento de ese ciclo: describir, generar, mirar, ajustar.
El modelo es lo que más importa. Modelos diferentes tienen puntos fuertes distintos:
SDXL
y sus fine-tunes de anime dibujan ilustraciones y personajes,
Flux
y
Z-Image
siguen prompts largos y generan texto legible,
Wan
y
LTX
hacen video. ModelTrends.ai existe para mostrar qué modelos usa la gente esta semana, así no tienes que adivinar. Cada página de modelo muestra imágenes de ejemplo con el prompt y ajustes exactos que las crearon, que es la forma más rápida de aprender.
No necesitas un PC para juegos para empezar. La forma más rápida de hacer tu primera imagen es en un servicio en la nube donde los modelos ya están instalados: una app web como
BitVector
, donde eliges un modelo y escribes, o el chat bot
PirateDiffusion
en Telegram, donde envías un comando. Ejecutar modelos en tu propia tarjeta gráfica viene después, cuando ya sabes qué modelos te gustan y si quieres gastar en hardware.

Referencia

Nombre
Tipo
Qué es
Prompt
text
Lo que quieres ver. Primero el sujeto, luego el lugar, después estilo y luz. El inglés simple funciona en modelos modernos; las listas de palabras clave funcionan en los más viejos.
Negative prompt
text
Lo que no quieres (borroso, dedos extra, marca de agua). Importa en
SD 1.5
y SDXL; Flux y otros modelos nuevos lo ignoran casi siempre.
Model / checkpoint
choice
El cerebro. Elige de la lista más popular en este sitio; la familia decide el estilo y cómo escribir el prompt.
Size
pixels
512x512 para SD 1.5, 1024x1024 para SDXL y Flux. Otras formas con el mismo número de píxeles funcionan (832x1216 retrato, 1216x832 paisaje).
Steps
number
Cuántas pasadas de refinamiento. 20 a 30 es lo normal; más es más lento y casi nunca mejor.
CFG / guidance
number
Qué tan estrictamente el modelo sigue el prompt. 5 a 7 en SDXL, 3.5 en Flux, 1 en modelos turbo o lightning.
Seed
number
El ruido inicial. La misma semilla con los mismos ajustes da la misma imagen, así puedes cambiar una cosa a la vez.
Sampler
choice
Las matemáticas para quitar el ruido. Euler o DPM++ 2M Karras son seguros; la página del modelo muestra qué usaron los ejemplos.
AD
Haz tu primera imagen sin instalar nada
BitVector Prism es una app web: elige uno de los modelos de este sitio, escribe el prompt del ejemplo arriba y genera. Nada que descargar, nada que configurar, funciona en un teléfono.

Paso a paso

  1. Abre el navegador de modelos en este sitio y ordena por popularidad. Elige un modelo base (un
    checkpoint
    , no un LoRA) de la familia SDXL o Flux; los fine-tunes de SDXL como DreamShaper XL o Juggernaut XL son fáciles para la primera prueba.
  2. Lee la página del modelo: mira tres o cuatro imágenes de ejemplo y sus prompts. Fíjate en el patrón: sujeto, escena, luz, cámara, palabras de estilo.
  3. Pulsa el botón Run en la página del modelo. BitVector abre una app web con el modelo preseleccionado; PirateDiffusion abre un chat en Telegram donde escribes /render seguido del prompt.
  4. Escribe un primer prompt copiando un ejemplo y cambiando solo el sujeto. Mantén el tamaño, pasos y sampler que usó el ejemplo.
  5. Genera cuatro imágenes, no solo una. El ruido aleatorio hace que algunas semillas sean mejores; juzgar un modelo por una sola imagen es un error.
  6. Cambia una cosa: añade una palabra de luz (golden hour, soft studio light), o una palabra de cámara (35mm, close-up), y genera otra vez. Así se aprende a hacer prompts.
  7. Marca con estrella los modelos que te gusten con el corazón en la tarjeta; la página Favs los guarda en tu navegador para que vuelvas sin cuenta.
  8. Cuando quieras usar localmente, lee la guía de
    VRAM
    y la guía para principiantes de
    ComfyUI
    en este sitio; los mismos prompts y modelos funcionan ahí.

Ejemplos

Un primer prompt para un modelo de foto SDXL

a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo, shallow depth of field
Negative: blurry, deformed hands, watermark, text | 1216x832 | DPM++ 2M Karras | 28 steps | CFG 6

La misma idea en PirateDiffusion (Telegram)

/render <dreamshaper-xl> a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo [[blurry, watermark]] /size:1216x832 /steps:28

Un prompt para Flux (sin negativo, guía más baja)

A candid photo of a fisherman mending a fishing net on a weathered pier at dawn. Soft fog over the water, warm low sun from the left, shallow depth of field, 35mm film look.
1216x832 | Euler | 24 steps | guidance 3.5

Consejos

  • El modelo es lo que más influye, el prompt lo segundo, los ajustes lo tercero. Los principiantes suelen invertir su tiempo en el orden equivocado.
  • Prompts cortos y concretos funcionan mejor que largos y vagos. "Una bicicleta roja apoyada en una pared blanca, luz de mañana, foto 50mm" es mejor que "hermosa impresionante asombrosa obra maestra 8k bicicleta".
  • Formas retrato para personas, formas paisaje para escenas. El cuadrado rara vez es la mejor forma para algo.
  • Guarda los prompts que te gusten en un archivo de texto. Cada página de modelo aquí muestra el prompt completo bajo sus ejemplos por la misma razón.
  • Los modelos de anime e ilustración (
    Illustrious
    , Pony, NoobAI) usan prompts estilo etiquetas; los modelos de foto (Flux, Z-Image, fine-tunes de foto SDXL) usan oraciones. La página de familias lo explica.
  • No descargues nada hasta que hayas usado un modelo en la nube y te haya gustado. Los checkpoints pesan entre 2 y 24 GB cada uno.

Solución de problemas

Todas las imágenes se ven iguales

Por qué ocurre
La semilla está fija, o el prompt es una lista de palabras genéricas de calidad.

Cómo arreglarlo
Pon la semilla en aleatorio, quita "masterpiece, 8k, best quality" de los prompts de foto, describe la escena en su lugar.

Las manos y caras están mal

Por qué ocurre
Caras y manos pequeñas en baja resolución, o un modelo viejo SD 1.5.

Cómo arreglarlo
Usa SDXL o Flux a 1024 píxeles, encuadra el sujeto más grande, o retoca la cara después (mira la guía de
inpainting
).

La imagen ignora la mitad del prompt

Por qué ocurre
Demasiadas ideas en un solo prompt, o CFG muy bajo.

Cómo arreglarlo
Un sujeto, un lugar, un estilo por prompt. Sube el CFG en uno en SDXL. Flux y
Qwen
siguen prompts largos mucho mejor que SD 1.5.

El texto en la imagen es un galimatías

Por qué ocurre
SD 1.5 y SDXL no saben escribir bien.

Cómo arreglarlo
Usa Flux,
FLUX.2
,
Qwen Image
o Z-Image y pon el texto entre comillas en el prompt.

Tarda minutos por imagen en mi portátil

Por qué ocurre
No tienes GPU dedicada, o una tarjeta con menos de 6 GB de memoria.

Cómo arreglarlo
Genera en la nube (BitVector, PirateDiffusion) y usa el portátil solo para ver resultados.

AD
PirateDiffusion
Miles de modelos en una ventana de chat
PirateDiffusion funciona en Telegram: envía /render y un prompt y la imagen vuelve en el chat. Todos los modelos y LoRAs de este sitio con botón Run ya están instalados ahí, con precio fijo mensual y generación ilimitada.

Preguntas

¿Tengo que pagar para probar esto?

Los socios en la nube enlazados desde las páginas de modelos te dejan empezar sin instalar nada; las herramientas locales (ComfyUI,
Forge
) son gratis pero necesitan una tarjeta gráfica con al menos 8 GB de memoria para los modelos actuales.

¿Con qué modelo debería empezar un principiante?

Un fine-tune SDXL para ilustración o un modelo dev Flux para fotos. La guía "qué modelos probar primero" en este sitio los ordena con razones.

¿Un LoRA es un modelo?

Un LoRA es un complemento que cambia un modelo base. Primero necesitas un modelo base (checkpoint); el LoRA va encima. La guía de LoRA lo explica.

¿Puedo hacer video también?

Sí, con Wan,
LTX-2
y
MiniMax H3
entre otros, pero el video necesita mucha más memoria localmente. Empieza en la nube; la guía de inicio en video lo cubre.

¿Las imágenes son mías?

Las licencias varían por modelo; la página del modelo enlaza la licencia. La mayoría de modelos abiertos permiten uso personal y comercial, algunas licencias solo para investigación (versiones tempranas de
Flux dev
) no.

¿Por qué mis resultados se ven peor que los ejemplos?

Normalmente por tamaño, sampler o número de pasos diferente. Copia primero los ajustes del ejemplo exactamente, luego cambia una cosa a la vez.

Enlaces y fuentes

Modelos de esta guía

Escrito por
Captain

Guías relacionadas

Modelos
Qué modelos de IA para imágenes probar primero y por qué: una lista inicial ordenada
Siete modelos para la primera semana, elegidos por ser tolerantes más que por la fama: un ajuste fino SDXL para fotos, un ajuste fino para anime, Flux dev, un modelo turbo rápido, un modelo de repintado, un modelo de video y un escalador, cada uno con la razón, la memoria que necesita y el estilo de prompt que espera.
Por Captain
2025-09-10
Prompting
Conceptos básicos para escribir prompts para imágenes AI: estructura, orden, pesos y los dos dialectos de prompt
Cómo escribir un prompt que funcione a la primera: el orden sujeto-escena-estilo, por qué importa la posición de las palabras, el dialecto de etiquetas de los modelos SDXL anime frente al dialecto de oraciones de Flux y Qwen, pesos de atención, límites de longitud del prompt y una lista para arreglar un prompt que se ignora.
Por Captain
2025-10-22
Modelos
Cómo funcionan los modelos generativos de imágenes AI: difusión, latentes y codificadores de texto explicados de forma sencilla
La mecánica detrás de Stable Diffusion, SDXL, Flux y los modelos de video sin las matemáticas: qué tiene que ver el ruido, por qué los modelos trabajan en un espacio latente comprimido, qué hacen el codificador de texto y el VAE, qué cambian realmente los pasos y la guía, y por qué los datos de entrenamiento deciden qué puede dibujar un modelo.
Por Quartermaster
2025-08-28
Modelos
Qué es un LoRA y cómo usar uno en ComfyUI, Forge, Automatic1111 y en la nube
LoRAs explicados para quienes quieren resultados, no matemáticas: qué cambia un archivo LoRA, por qué debe coincidir con la familia del modelo base, palabras clave, pesos, combinar varios LoRAs, la carpeta y sintaxis para cada interfaz, y cómo probar un LoRA en la nube antes de descargar nada.
Por Captain
2026-05-20
Servicios en la nube
PirateDiffusion: ejecuta cualquier modelo desde Telegram, no se necesita GPU
Los comandos importantes en el bot de Telegram PirateDiffusion: /render con palabras clave de modelo, ponderación con (( )) y [[ ]], #recipes, /adetailer, escalado con /highdef y /facelift, /remix, /inpaint, flujos de trabajo ComfyUI con /wf /run:, y las nuevas habilidades // que eligen el modelo por ti.
Por Captain
2026-10-03

Más guías

Modelos
FLUX.1 Dev: cómo usar prompts, mejores ajustes e ideas creativas
Una guía práctica de FLUX.1 Dev de Black Forest Labs: cómo usar prompts en lenguaje natural, ajustes de guía y pasos, apilamiento de LoRA, renderizado de texto e ideas para aprovechar sus puntos fuertes.
Por Captain
2026-09-30
Modelos
Stable Diffusion XL 1.0: prompts, configuraciones y en qué sigue destacando
Cómo sacar el máximo provecho del modelo base oficial SDXL 1.0: resoluciones nativas, configuraciones de CFG y sampler, el refinador, prompts negativos e ideas para estilos donde SDXL todavía brilla.
Por Captain
2026-10-01
Modelos
Stable Diffusion 1.5: el modelo clásico, usado correctamente
Stable Diffusion 1.5 sigue siendo importante: la resolución adecuada, CFG y sampler, cómo usar su enorme biblioteca de LoRAs y embeddings, y ideas creativas para prompts adaptadas a un modelo de 512 píxeles.
Por Captain
2026-10-02
Modelos
FLUX.2 Dev: cómo usar el modelo más nuevo de Black Forest Labs
FLUX.2 Dev trae prompts más largos, mejor texto, realismo más fuerte y edición con múltiples referencias. Esta guía cubre el flujo turbo, ajustes de guía y resolución, estructura del prompt e ideas que aprovechan sus nuevas fortalezas.
Por Captain
2026-10-03
Modelos
Qwen-Image: prompts largos, texto perfecto y carteles bilingües
Qwen-Image es el modelo al que acudir cuando las palabras en la imagen importan. Aprende a escribir sus prompts largos y descriptivos, a renderizar texto en inglés y chino con precisión, a configurar CFG y pasos, y a explorar ideas creativas con mucho diseño.
Por Captain
2026-09-29
Modelos
SDXL-Lightning: generación en cuatro pasos en cualquier checkpoint SDXL
El LoRA SDXL-Lightning de ByteDance convierte un render SDXL de 30 pasos en uno de 4 pasos. Aprende cuántos pasos usar, el CFG que necesitas, el sampler y cómo combinarlo con tus checkpoints y LoRAs de estilo favoritos.
Por Captain
2026-09-30