Model
Trends
.ai
Model
Trends
.ai
i migliori modelli di IA open source

Guida a Qwen-Image-Edit: prompt di istruzioni, modifica multi-immagine e i LoRA che la migliorano

Argomento: Prompting
Di Captain
Pubblicato il 2026-05-26
Come ottenere modifiche pulite da Qwen-Image-Edit: scrivere istruzioni invece di descrizioni, mantenere identità e layout, input multi-immagine, sostituzione del testo, controllo di posa e profondità, i LoRA lightning per modifiche in 4 passaggi e i LoRA anything-to-real e slider che stanno andando di moda nella famiglia Qwen2.

Panoramica

Qwen-Image-Edit è il modello di editing della linea
Qwen-Image
di Alibaba: gli dai un'immagine e un'istruzione, e ti restituisce l'immagine con quella modifica senza cambiare altro. La versione 2509 ha aggiunto più immagini in input (metti la giacca dell'immagine due sulla persona nell'immagine uno), una migliore conservazione dell'identità, guida per posa e profondità e la stessa resa del testo che ha reso famoso Qwen-Image, così puoi sostituire un cartello o un'etichetta con parole esatte.
In questo catalogo la generazione di editing e i suoi
LoRA
fanno parte della famiglia Qwen2. I suoi LoRA sono tra i più in crescita sul sito: conversioni anything-to-real che trasformano disegni e rendering in fotografie, slider per età e corpo, deblurring, rimozione watermark, LoRA di consistenza che mantengono un personaggio tra le modifiche, e i LoRA lightning che riducono una modifica da 40 passaggi a 4.
Il modello ha 20 miliardi di parametri, quindi la maggior parte delle persone lo usa quantizzato (fp8 o GGUF) su 12-24 GB o in hosting:
PirateDiffusion
lo espone come workflow edit-qwen (/wf /run:edit-qwen con un'immagine in input) e
BitVector
ce l'ha nell'app web con i LoRA preinstallati.

Riferimento

Nome
Tipo
Cos'è
Prompt di istruzione
text
Una frase imperativa: "Cambia la maglietta in rosso", "Rimuovi la persona a sinistra", "Sostituisci il testo del cartello con OPEN 24H". Non una descrizione della scena.
Immagine 1 (e 2, 3)
input
L'immagine da modificare; immagini extra forniscono un oggetto di riferimento, uno stile o una seconda persona. Specifica quale immagine è quale nel prompt.
Passaggi / CFG
setting
40 passaggi,
CFG
base 4. Con il LoRA lightning 4 o 8 passaggi e CFG 1.
Denoise
setting
Mantieni 1.0; il modello decide cosa cambiare dall'istruzione. Valori più bassi sfocano le modifiche.
Risoluzione
setting
Il modello lavora vicino a 1 megapixel; il template
ComfyUI
scala l'input e poi lo riporta alla dimensione originale. Input molto grandi vengono ridimensionati.
Controllo posa / profondità
input
Uno scheletro di posa o una mappa di profondità come immagine extra con "segui la posa dell'immagine 2".
Sostituzione testo
prompt
Metti il testo esatto tra virgolette e indica dove va: Sostituisci il testo sulla tazza con "World's OK Dad".
Lightning LoRA
LoRA
Qwen-Image-Edit-Lightning 4-step o 8-step; peso 1.0; CFG 1.
LoRA di stile e conversione
LoRA
anything2real, anime2real, cinematic, morereal: peso da 0.8 a 1.0, aggiunti all'istruzione con le loro parole trigger.
AD
Nessuna installazione: esegui i modelli IA nel cloud
BitVector Prism è il modo più semplice per iniziare: scegli un modello, scrivi un prompt e genera in una web app pulita, senza configurare nulla. BitVector è disponibile anche su Discord e sul web (SpyGlass).

Passo dopo passo

  1. Carica il template ComfyUI Qwen-Image-Edit (Browse Templates > Image > Qwen Image Edit) e imposta i loader: il modello di diffusione per editing (fp8 o GGUF), il codificatore testuale Qwen2.5-VL, il VAE
    Qwen
    .
  2. Trascina l'immagine nel nodo Load Image. Scrivi un'istruzione singola. Mantieni tutto ciò che non menzioni invariato; il modello lo preserva.
  3. Esegui a 40 passaggi / CFG 4 una volta per vedere il risultato base; poi aggiungi il LoRA lightning dalla pagina della famiglia Qwen2 e passa a 8 passaggi / CFG 1.
  4. Per modifiche multi-immagine, aggiungi un secondo Load Image e riferisciti a esso: "Metti gli occhiali da sole dell'immagine 2 sull'uomo nell'immagine 1." Le immagini di riferimento funzionano meglio ritagliate sull'oggetto.
  5. Per il testo: scrivi la stringa esatta tra virgolette, indica la superficie e chiedi lo stesso font o colore se vuoi continuità.
  6. Per conversioni, aggiungi il LoRA e la sua parola trigger all'istruzione: "anything2real, trasforma questa illustrazione in una fotografia realistica, mantieni la composizione."
  7. Modifiche a catena: reinserisci l'output come immagine 1 per l'istruzione successiva invece di chiedere tre modifiche insieme.
  8. In hosting: su PirateDiffusion rispondi a una foto con /wf /run:edit-qwen cambia la maglietta in rosso, o usa /workflow /show:edit-qwen per leggere i campi; su BitVector scegli il modello di editing e carica l'immagine.

Esempi

Modifiche singole

Change the man's jacket to a dark green wool coat, keep everything else the same
Remove the car in the background and extend the hedge
Replace the text on the storefront sign with "CAFE LUNA" in the same style

Due immagini

Put the handbag from image 2 on the woman's shoulder in image 1, match the lighting of image 1

LoRA di conversione

anything2real, convert this anime illustration into a realistic photograph of the same scene, same pose and framing, natural skin, 50mm lens

PirateDiffusion

/wf /run:edit-qwen /initimage:Ixyz123 change the shirt to red

Consigli

  • Una modifica per istruzione dà il risultato più pulito; accumula le modifiche a catena.
  • Dì cosa mantenere quando conta: "mantieni il viso e i capelli esattamente uguali" migliora visibilmente l'identità.
  • Le modifiche di illuminazione ("fallo ora d'oro") funzionano; i cambi di prospettiva ("mostralo dall'alto") funzionano in 2509 ma servono qualche seed.
  • I prompt negativi sono poco efficaci qui; formula l'istruzione in modo positivo.
  • Per foto di prodotto, un riferimento semplice del prodotto come immagine 2 è meglio che descriverlo.
  • Gli slider nella famiglia Qwen2 (età, corpo, dettaglio) accettano pesi negativi per l'opposto; la pagina del modello indica l'intervallo.
  • I LoRA per rimozione watermark e deblurring si usano con l'istruzione neutra data dall'autore ("rimuovi il watermark", "deblur questa foto") e niente altro.

Risoluzione dei problemi

L'intera immagine è cambiata

Perché succede
Un prompt descrittivo invece di un'istruzione, o denoise sotto 1 in un workflow diverso.

Come risolverlo
Scrivi un cambiamento imperativo singolo; usa il template ufficiale con denoise 1.0.

Il viso è cambiato

Perché succede
Modifica grande vicino al viso o un LoRA di stile a piena forza.

Come risolverlo
Aggiungi "mantieni il viso identico", abbassa il LoRA a 0.7, usa un LoRA di consistenza.

Il testo ha errori

Perché succede
Stringa lunga o richiesta di font insolito.

Come risolverlo
Testo più corto tra virgolette, una riga, chiedi un font semplice; esegui due o tre seed.

Memoria insufficiente

Perché succede
Modello 20B in fp16.

Come risolverlo
Pesi fp8 o GGUF Q4 e codificatore testuale fp8; o in hosting.

Modifica ignorata con il LoRA lightning

Perché succede
CFG lasciato a 4 o passaggi troppo bassi per la versione del LoRA.

Come risolverlo
CFG 1, passaggi corrispondenti al LoRA (4 o 8).

Seconda immagine non usata

Perché succede
Il prompt non faceva riferimento esplicito all'immagine 2.

Come risolverlo
Nomina le immagini nell'istruzione.

AD
PirateDiffusion
Nessuna installazione: esegui i modelli IA nel cloud
PirateDiffusion è solo su Telegram ed è pensato per i professionisti: migliaia di modelli, LoRA e workflow tramite comandi in chat, con generazione illimitata a prezzo fisso.

Domande

Qwen-Image-Edit o FLUX.2 per modifiche?

Qwen per testo esatto e seguire istruzioni su un'immagine singola;
FLUX.2
per composizioni multi-riferimento e quando generi anche da zero. Entrambi sono su questo sito con Run boxes.

È adatto all'uso commerciale?

I modelli Qwen-Image sono Apache 2.0. Controlla la licenza nelle pagine dei singoli LoRA.

Perché qui la famiglia si chiama Qwen2?

Il catalogo separa la generazione di editing (2509) e i suoi LoRA dalla prima release Qwen-Image così i LoRA non si mescolano tra versioni.

Può modificare frame video?

Un frame alla volta; per video usa
Wan 2.2
I2V da un primo frame modificato.

Dove posso provarlo più velocemente?

PirateDiffusion (/wf /run:edit-qwen su Telegram) o BitVector nel browser; entrambi hanno il LoRA lightning installato.

Link e fonti

Modelli di questa guida

Scritto da
Captain

Guide correlate

Prompting
Guida al prompting di FLUX.2: prompt in linguaggio naturale, multi-riferimento, editing e LoRA
Come ottenere i risultati per cui FLUX.2 dev è noto: prompt a paragrafi con soggetto, scena, luce e obiettivo, testo esatto tra virgolette, fino a diverse immagini di riferimento per prodotti, persone e stili, modifiche in stile istruzione, le impostazioni di guida e passi che contano, e come i LoRA di FLUX.2 differiscono da quelli di Flux dev.
Di Captain
2026-05-28
Modelli
Flux vs SDXL vs SD 1.5 vs Qwen vs Z-Image: quale famiglia di modelli usare nel 2026
Un confronto pratico tra le famiglie di modelli open per immagini: capacità di seguire il prompt, realismo, anime e illustrazione, rendering del testo, velocità, VRAM, ecosistema LoRA e licenza, con una raccomandazione per ogni tipo di lavoro e hardware.
Di Captain
2026-05-22
Errori e soluzioni
CUDA memoria esaurita: quanta VRAM serve a ogni modello AI e come farlo entrare
Una tabella della VRAM per SD 1.5, SDXL, Flux, FLUX.2, Qwen-Image, Z-Image, Wan 2.2 e HunyuanVideo, e le tecniche per far entrare un modello: quantizzazione fp8 e GGUF, offload su CPU, VAE a tiles, limiti di risoluzione e frame, e quando smettere di lottare e usarlo in hosting.
Di Captain
2026-05-18
Servizi cloud
PirateDiffusion: usa qualsiasi modello da Telegram, senza bisogno di GPU
I comandi principali del bot PirateDiffusion su Telegram: /render con parole trigger del modello, pesi con (( )) e [[ ]], #recipes, /adetailer, upscaling con /highdef e /facelift, /remix, /inpaint, workflow ComfyUI con /wf /run:, e le nuove abilità // che scelgono il modello per te.
Di Captain
2026-10-03

Altre guide

Modelli
FLUX.1 Dev: come usarlo, impostazioni migliori e idee creative
Una guida pratica a FLUX.1 Dev di Black Forest Labs: come scrivere i prompt in linguaggio naturale, impostazioni di guida e passi, stacking di LoRA, rendering del testo e idee per prompt che sfruttano i suoi punti di forza.
Di Captain
2026-09-30
Modelli
Stable Diffusion XL 1.0: prompt, impostazioni e cosa fa ancora meglio
Come ottenere il massimo dal modello base ufficiale SDXL 1.0: risoluzioni native, impostazioni di CFG e sampler, il refiner, prompt negativi e idee per stili in cui SDXL brilla ancora.
Di Captain
2026-10-01
Modelli
Stable Diffusion 1.5: il modello classico, usato nel modo giusto
Stable Diffusion 1.5 vale ancora la pena conoscerlo: la risoluzione giusta, CFG e sampler, come usare la sua enorme libreria di LoRA e embedding, e idee creative per prompt adatte a un modello a 512 pixel.
Di Captain
2026-10-02
Modelli
FLUX.2 Dev: come usare il modello più recente di Black Forest Labs
FLUX.2 Dev supporta prompt più lunghi, testo migliore, realismo più forte e modifica con riferimenti multipli. Questa guida spiega il flusso turbo, le impostazioni di guida e risoluzione, la struttura del prompt e idee che sfruttano le sue nuove potenzialità.
Di Captain
2026-10-03
Modelli
Qwen-Image: prompt lunghi, testo perfetto e poster bilingue
Qwen-Image è il modello da usare quando le parole nell'immagine contano. Scopri come scrivere prompt descrittivi lunghi, riprodurre testo in inglese e cinese con precisione, impostare CFG e passi, e esplorare idee creative con layout complessi.
Di Captain
2026-09-29
Modelli
SDXL-Lightning: generazione in quattro passaggi su qualsiasi checkpoint SDXL
Lo LoRA SDXL-Lightning di ByteDance trasforma un rendering SDXL da 30 passaggi in uno da 4. Scopri il numero di passaggi, il CFG da usare, il sampler e come combinarlo con i tuoi checkpoint e LoRA di stile preferiti.
Di Captain
2026-09-30