Model
Trends
.ai
Model
Trends
.ai
i migliori modelli di IA open source

Ingrandimento delle immagini AI: modelli ESRGAN, hires-fix, diffusione a piastrelle e quando usarli

Argomento: Modelli
Di Quartermaster
Pubblicato il 2026-03-04
Share

Panoramica

I modelli per immagini funzionano bene alla loro dimensione nativa (512 per
SD 1.5
, 1024 per
SDXL
e
Flux
) e male molto oltre; quindi il modo per ottenere un'immagine grande è generare alla dimensione nativa e ingrandire dopo. Ci sono tre modi per ingrandire, e non sono intercambiabili. Gli ingranditori pixel sono piccole reti (famiglia ESRGAN, SwinIR, DAT) che affinano mentre ridimensionano; sono veloci, fedeli e non aggiungono contenuti nuovi. Hires-fix è un secondo passaggio di diffusione a dimensione maggiore durante la generazione che aggiunge dettagli reali con un denoise moderato. La diffusione a piastrelle divide un'immagine grande in piastrelle sovrapposte e applica
img2img
su ciascuna, che può inventare dettagli plausibili a 4K e oltre, guidata da un Tile
ControlNet
per mantenere la fedeltà delle piastrelle.
Quale usare dipende dall'obiettivo. Per web e social, un ingrandimento pixel 2x di un render pulito è sufficiente e richiede due secondi. Per stampe, prodotti e sfondi, un ingrandimento pixel 2x seguito da un passaggio di diffusione a piastrelle con basso denoise dà i dettagli che ci si aspetta dall’"arte AI 4K". Hires-fix sta nel mezzo ed è il default in
Forge
e A1111 per un motivo: sistema i volti sfocati a 1024 senza un secondo flusso di lavoro.
La famiglia
Upscalers
su questo sito elenca gli ingranditori pixel con il loro uso previsto (foto, anime, volti, testo) e gli enhancer basati su diffusione con la loro famiglia base. I partner cloud usano gli stessi strumenti:
PirateDiffusion
ha i comandi /upscale e /enhance,
BitVector
un pulsante di ingrandimento accanto a ogni risultato.

Riferimento

Nome
Tipo
Cos'è
4x-UltraSharp
pixel upscaler, ESRGAN
Il default per foto e render: nitido, leggermente granuloso; ridimensiona a 2x dopo per un aspetto naturale.
Real-ESRGAN x4plus / x4plus-anime
pixel upscaler
Robusto e generico; la variante anime mantiene le linee pulite nelle illustrazioni.
4x-NMKD-Siax, 4x-Foolhardy-Remacri
pixel upscaler
Alternative più delicate a UltraSharp; Remacri per foto morbide, Siax per texture dettagliate.
SwinIR / DAT / HAT
pixel upscaler, transformer
Fedeltà più alta, più lento; migliore per fotografie dove ESRGAN inventa texture.
Hires-fix
generation setting
Ingrandisci di 1.5-2x con un ingranditore pixel poi denoise 0.3-0.5 alla nuova dimensione. Checkbox in A1111/Forge;
ComfyUI
come secondo KSampler.
Ultimate SD Upscale
tiled diffusion
Piastrelle da 1024 con sovrapposizione di 64 px, denoise 0.2-0.35, Tile ControlNet attivo. Trasforma 2048 in 4096 con nuovi dettagli.
SUPIR /
Flux
tiled / SeedVR
diffusion restorers
Modelli pesanti che restaurano e migliorano immagini vecchie o di bassa qualità; 16 GB+ e minuti per immagine.
Denoise
0.2-0.5
In qualsiasi ingrandimento con diffusione, quanto può cambiare. 0.2 mantiene tutto; 0.5 ridisegna texture e può alterare i volti.
AD
Ingrandimento con un clic
Ogni immagine che crei in BitVector Prism ha un pulsante Upscale che usa l’ingranditore giusto per il modello; il risultato si scarica a 2x o 4x. Nessun file modello da raccogliere.

Passo dopo passo

  1. Genera alla dimensione nativa e sistema prima composizione e volti (inpainting); l'ingrandimento amplifica i difetti invece di correggerli.
  2. Percorso veloce: Upscale Image (using Model) con 4x-UltraSharp, poi Image Scale a 2x dell’originale. Fatto in pochi secondi; buono per il web.
  3. Percorso hires-fix (Forge, A1111): attiva Hires. fix, ingranditore 4x-UltraSharp o Latent, ingrandisci di 1.5-2, passi hires 15, denoise 0.4. In ComfyUI: Upscale Latent By 1.5 -> secondo KSampler con denoise 0.45.
  4. Percorso stampa: ingrandimento pixel a 2x, poi Ultimate SD Upscale con lo stesso
    checkpoint
    , tile 1024, padding 32, denoise 0.25, forza Tile ControlNet 0.6, correzione giunture "half tile". Aspettati diversi minuti.
  5. Volti: dopo l’ingrandimento esegui un passaggio con face detailer (ADetailer, nodo FaceDetailer) a denoise 0.35; immagini grandi rendono i volti piccoli di nuovo.
  6. Affina leggermente e esporta come PNG per stampe, WebP o JPEG 92 per il web. Confronta con il render 1x al 100% per individuare artefatti inventati.
  7. Sul cloud: rispondi a un risultato PirateDiffusion con /upscale (pixel) o /enhance (diffusione); in BitVector premi Upscale sulla scheda immagine.

Esempi

ComfyUI rapido 2x

VAE Decode -> Upscale Image (using Model: 4x-UltraSharp) -> Image Scale (0.5, lanczos) -> Save Image

Impostazioni hires-fix in Forge

Hires. fix: upscaler 4x-UltraSharp | upscale by 1.5 | hires steps 15 | denoising strength 0.4 | same seed

Ultimate SD Upscale per una stampa

Input 2048x2048 (after 2x pixel upscale) | upscale_by 2 | tile 1024x1024 | mask blur 16 | padding 32 | denoise 0.25 | ControlNet Tile 0.6 | seam fix half tile

Consigli

  • Ingrandisci il finale, non ogni bozza; un passaggio 4x su un render 1024 è 16 milioni di pixel e richiede tempo reale.
  • I modelli ESRGAN sono addestrati per 4x; usarli a 2x significa fare 4x e poi ridimensionare, ecco perché l’output sembra troppo nitido se salti il ridimensionamento.
  • Anime e illustrazioni piatte hanno bisogno delle varianti anime o le linee raddoppiano; le foto hanno bisogno di SwinIR, DAT o Remacri o la pelle sembra plastica.
  • Nella diffusione a piastrelle mantieni il prompt corto e generico ("altamente dettagliato, fuoco nitido, pelle naturale") così nessuna piastrella inventa un soggetto nuovo.
  • L’ingrandimento latente in hires-fix ha bisogno di denoise 0.5+ per essere nitido; gli ingranditori pixel in hires-fix funzionano a 0.3-0.4 e mantengono l’immagine più vicina all’originale.
  • La pagina della famiglia Upscalers ordina per popolarità; i primi tre coprono il 90% delle esigenze.

Risoluzione dei problemi

Immagine ingrandita sembra troppo nitida e granulosa

Perché succede
Output 4x ESRGAN mantenuto a 4x.

Come risolverlo
Ridimensiona a 2x, o usa Remacri/SwinIR.

Volti cambiati dopo il passaggio a piastrelle

Perché succede
Denoise troppo alto; le piastrelle hanno rielaborato il volto.

Come risolverlo
Denoise 0.2-0.25, Tile ControlNet attivo, face detailer dopo.

Giunture della griglia visibili

Perché succede
Sovrapposizione bassa o nessuna correzione giunture.

Come risolverlo
Padding 32-64, modalità correzione giunture, o SUPIR per restauro in un passaggio.

Hires-fix produce arti raddoppiati

Perché succede
Fattore di ingrandimento o denoise troppo alto per il modello.

Come risolverlo
Ingrandisci massimo 1.5, denoise 0.4, o usa un ingranditore pixel invece di latente.

Memoria esaurita al passaggio di decodifica

Perché succede
Decodifica VAE a dimensione piena di un’immagine 4K.

Come risolverlo
VAE Decode (Tiled) e piastrelle più piccole.

AD
PirateDiffusion
/upscale e /enhance dalla chat
Rispondi a qualsiasi render PirateDiffusion con /upscale per un 4x pulito o /enhance per un passaggio di diffusione a piastrelle con nuovi dettagli. Le GPU del server fanno il lavoro pesante; passaggi illimitati a prezzo fisso.

Domande

Qual è il miglior ingranditore?

4x-UltraSharp per la maggior parte dei render, Real-ESRGAN anime per illustrazioni, SwinIR o DAT per foto. La pagina famiglia Upscalers li ordina per uso.

L’ingrandimento sistema mani brutte?

No; le ingrandisce. Prima fai inpainting, poi ingrandisci.

Quanto posso ingrandire?

Ingranditori pixel a qualsiasi dimensione; diffusione a piastrelle fino a 8K con pazienza. Oltre 4x il modello inventa più di quanto conserva.

Hires-fix è lo stesso dell’ingrandimento?

È un ingrandimento con un passaggio di diffusione dentro la generazione; aggiunge dettagli, un ingranditore semplice no.

Posso ingrandire video?

Sì: frame per frame con ESRGAN (veloce, rischio flicker) o con restauratori video come SeedVR; le guide video lo spiegano.

Link e fonti

Modelli di questa guida

Scritto da
Quartermaster

Guide correlate

Prompting
Basi di img2img, inpainting e outpainting: correggere le mani, scambiare oggetti ed estendere un'immagine
I tre modi per generare a partire da un'immagine esistente invece che dal rumore: img2img per restyling con un valore di denoise, inpainting per ridipingere solo un'area mascherata (la correzione standard per mani e volti), e outpainting per estendere la tela; con le scelte di denoise, padding e modello per SD 1.5, SDXL, Flux Fill e Qwen Image Edit.
Di Captain
2025-12-03
Prompting
ControlNet spiegato: posa, profondità, contorni e immagini di riferimento per SD 1.5, SDXL e Flux
Come ControlNet fa sì che un modello segua una posa, una mappa di profondità, un disegno di contorni o uno scarabocchio invece di indovinare la composizione dal prompt: i tipi di controllo più comuni e quando usare ciascuno, il passaggio del preprocessore, le impostazioni di forza e percentuale finale, i file specifici per famiglia e le alternative dell’era Flux (Flux Depth, Canny, Kontext).
Di Captain
2026-02-18
Modelli
Krea2 Enhancer: dettagli e illuminazione più puliti per qualsiasi stile Krea 2
Il Krea2 Enhancer LoRA di vrgamedevgirl migliora le immagini Krea 2 in stili realistici, anime, prodotto e fantasy senza cambiare l'intento del prompt. Scopri il peso, il flusso di lavoro e le idee.
Di Captain
2026-09-30
Prompting
Passi, CFG, sampler, scheduler e seed: le impostazioni di generazione spiegate con valori sicuri
Cosa cambia ogni impostazione nel pannello di generazione, i valori che funzionano per famiglia di modelli (SD 1.5, SDXL, Flux, Qwen, Z-Image, Wan), quali sampler vale la pena conoscere, perché i modelli distillati rompono le regole usuali e come usare i seed per cambiare una cosa alla volta.
Di Quartermaster
2025-11-19
Modelli
LTX 2.3 Crisp Enhance: dettagli video più nitidi e cinematografici
Il Crisp Enhance LoRA di vrgamedevgirl per LTX 2.3 aumenta nitidezza, micro-dettagli e contrasto nei video generati. Scopri come bilanciarlo con il fratello Soft Enhance, i pesi e alcune idee per i prompt.
Di Captain
2026-10-03

Altre guide

Servizi cloud
Tariffa fissa vs token: perché i piani illimitati come Graydient.ai sono il miglior valore per i creatori AI nel 2026
Un confronto dei costi classificato, con prezzi aggiornati all'8 ottobre 2026, tra piani illimitati a tariffa fissa come Graydient.ai e prezzi a token e credito di Midjourney, Leonardo, fal.ai, Replicate, Runway e Kling: quanto costano davvero 1.000 immagini e 1.000 video al mese su ciascuno, e perché una tariffa fissa per immagini, video, audio, chat Grok LLM e app web illimitate è il miglior valore per i creatori che fanno iterazioni.
Di Captain
2026-10-08
Modelli
FLUX.1 Dev: come usarlo, impostazioni migliori e idee creative
Una guida pratica a FLUX.1 Dev di Black Forest Labs: come scrivere i prompt in linguaggio naturale, impostazioni di guida e passi, stacking di LoRA, rendering del testo e idee per prompt che sfruttano i suoi punti di forza.
Di Captain
2026-09-30
Modelli
Stable Diffusion XL 1.0: prompt, impostazioni e cosa fa ancora meglio
Come ottenere il massimo dal modello base ufficiale SDXL 1.0: risoluzioni native, impostazioni di CFG e sampler, il refiner, prompt negativi e idee per stili in cui SDXL brilla ancora.
Di Captain
2026-10-01
Modelli
Stable Diffusion 1.5: il modello classico, usato nel modo giusto
Stable Diffusion 1.5 vale ancora la pena conoscerlo: la risoluzione giusta, CFG e sampler, come usare la sua enorme libreria di LoRA e embedding, e idee creative per prompt adatte a un modello a 512 pixel.
Di Captain
2026-10-02
Modelli
FLUX.2 Dev: come usare il modello più recente di Black Forest Labs
FLUX.2 Dev supporta prompt più lunghi, testo migliore, realismo più forte e modifica con riferimenti multipli. Questa guida spiega il flusso turbo, le impostazioni di guida e risoluzione, la struttura del prompt e idee che sfruttano le sue nuove potenzialità.
Di Captain
2026-10-03
Modelli
Qwen-Image: prompt lunghi, testo perfetto e poster bilingue
Qwen-Image è il modello da usare quando le parole nell'immagine contano. Scopri come scrivere prompt descrittivi lunghi, riprodurre testo in inglese e cinese con precisione, impostare CFG e passi, e esplorare idee creative con layout complessi.
Di Captain
2026-09-29