Wan 2.2 video: nastavení text-to-video a image-to-video, nastavení a LoRA
Téma: Video modely
Autor: Captain
Publikováno 2026-05-24
První výsledky s Wan 2.2: jakou velikost modelu vybrat (5B nebo 14B), pár expertů vysoký šum / nízký šum, rozlišení a počet snímků, které fungují, lightning LoRA, které zkracují render na čtyři kroky, struktura promptu pro pohyb a jak to spustit hostované, když má karta málo paměti.
Přehled
Wan 2.2
je otevřená video rodina od Alibaba a nejstahovanější video model na tomto webu. Je dostupný jako 5B hybridní model pro text- a image-to-video, určený pro běžné karty (720p na 8 až 12 GB), a jako 14B text-to-video a image-to-video modely, které používají dva experty: model s vysokým šumem, který v prvních krocích nastavuje pohyb a kompozici, a model s nízkým šumem, který v posledních krocích přidává detaily. Pár 14B dává ty filmové výsledky, které lidé sdílí; 5B model je ten, na kterém se učíš.
Komunita natrénovala stovky
Wan
LoRAs
: pohyby kamery (orbit, dolly, crash zoom), styly pohybu, postavy, efekty a lightning / distilační LoRA, které zkracují 30-krokové rendery na 4 až 8 kroků s minimální ztrátou. Stránka Wan family je řadí podle popularity; lightning LoRA jsou skoro vždy nahoře.
Hostované možnosti jsou vhodné pro video, protože rendery jsou dlouhé a žerou hodně
VRAM
:
PirateDiffusion
spouští Wan workflow z Telegramu s /wf /run a
BitVector
má Wan grafy předinstalované s LoRA. Obojí je odkazováno v Run boxu na každé stránce Wan modelu.
Reference
Název | Typ | Co to je |
|---|---|---|
Wan2.2-TI2V-5B | model | Jeden model pro text- a image-to-video, 720p při 24 fps, max 121 snímků. fp16 10 GB, fp8 5 GB. Karty 8 až 12 GB. |
Wan2.2-T2V-A14B / I2V-A14B | model pair | Experti vysoký šum a nízký šum, každý 14B (celkem 27B, aktivních 14B). 480p a 720p. fp8 cca 14 GB každý; GGUF Q4 cca 8 GB každý. |
umt5-xxl text encoder | file | fp8 scaled (6 GB) nebo fp16 (11 GB). Sdílený všemi Wan modely. |
Wan 2.1 / 2.2 VAE | file | 5B model používá 2.2 VAE; 14B modely používají 2.1 VAE. Míchání dává špatné výsledky. |
Resolution | setting | 480x832 nebo 832x480 pro rychlé testy; 720x1280 / 1280x720 pro finální. Násobky 16. |
Frames | setting | 4n+1: 33, 49, 65, 81. 81 snímků při 16 fps je pět sekund. |
Steps / shift / CFG | setting | 20 až 30 kroků, shift 5 až 8, CFG 3.5 až 5 bez lightning. S lightning LoRA: 4 až 8 kroků, CFG 1, shift 5. |
Lightning / distill LoRA | LoRA | Samostatné LoRA pro experty vysoký a nízký šum; načti každou na svůj model. Váha 1.0. |
Prompt | text | Předmět, akce, kamera, osvětlení, styl, v tomto pořadí. Pohyb popisuj slovesy. Negativní prompt Wan používá (na rozdíl od Flux ). |
AD

Bez instalace - spouštějte AI modely v cloudu
BitVector Prism je nejsnazší způsob, jak začít: vyberte model, napište prompt a generujte v přehledné webové aplikaci, bez jakéhokoli nastavování. BitVector je k dispozici také na Discordu a na webu (SpyGlass).
Krok za krokem
- Nainstaluj loadery:ComfyUIcore podporuje Wan 2.2; přidej ComfyUI-GGUF pro kvantované soubory. Nejprve aktualizuj ComfyUI.
- Stáhni podle své karty: 5B fp8 plus 2.2 VAE a umt5 fp8 na 8 až 12 GB; 14B fp8 pár plus 2.1 VAE na 24 GB; 14B GGUF Q4 pár na 12 až 16 GB.
- Načti oficiální šablonu (Workflow > Browse Templates > Video > Wan 2.2) a nahraď loadery svými soubory. Pro GGUF vyměň Load Diffusion Model za Unet Loader (GGUF).
- Pro 14B: dva KSampler Advanced uzly. První běží vysoký šum od kroků 0 do N/2 (vrací s ponechaným šumem), druhý běží nízký šum od N/2 do N. Šablona to už má zapojené.
- První render: 480x832, 33 snímků, 20 kroků, CFG 4, shift 8, prompt "a corgi runs along a beach at sunset, camera tracks alongside, golden light, shallow depth of field". Čas 2 až 6 minut.
- Přidej lightning LoRA z Wan family stránky (jednu pro každého experta), nastav kroky na 6 (3 + 3), CFG 1. Rendery klesnou pod minutu při 480p.
- Image-to-video: načti I2V pár, nahraj obrázek do WanImageToVideo, prompt nech o pohybu a kameře, ne o obrázku.
- Finální: 720p, 81 snímků, interpoluj na 32 fps s RIFE nebo FILM, případně zvětši video upscalerem z rodinyUpscalers.
- Příliš pomalé nebo velké: spusť stejný workflow na BitVector, nebo na PirateDiffusion s /workflow /show:wan pro zobrazení polí a /wf /run:wan s tvým promptem.
Příklady
Prompt pro text-to-video
A fisherman in a yellow raincoat hauls a net onto a small wooden boat in heavy rain, waves rock the boat, the camera is handheld and close, grey stormy light, cinematic, 35mm film grain
Negative: overexposed, static, blurry details, subtitles, worst quality, low quality, deformed, extra fingers, still image
Prompt pro image-to-video (jen pohyb)
The woman turns her head toward the camera and smiles, wind moves her hair, slow push-in, soft daylight
PirateDiffusion
/workflow /show:wan-i2v
/wf /run:wan-i2v /initimage:Iabc123 the woman turns her head toward the camera and smiles, wind moves her hair, slow push-in
Tipy
- Pohyb popisuj slovesy a kameru filmovými výrazy (slow dolly in, handheld, static wide shot). Wan zvládá jazyk kamery neobvykle dobře.
- Nezapomeň na negativní prompt: oficiální obsahuje přeexpozici, statické scény, rozmazané detaily, titulky, nejhorší kvalitu, extra prsty a pomáhá to.
- Počet snímků stojí víc než rozlišení: 81 snímků při 480p je levnější než 49 snímků při 720p.
- Motion LoRA pro Wan jsou označené podle experta, na kterého cílí; LoRA jen pro nízký šum přidává detaily, LoRA pro vysoký šum mění pohyb.
- Seed je u videa hodně důležitý; při ladění promptu ho nech stejný, pak ho měň pro různé záběry.
- Ulož workflow s tvou sadou LoRA jako šablonu; Wan grafy jsou dlouhé a snadno se rozbijí.
Řešení problémů
Nedostatek paměti u prvního sampleru
Proč k tomu dochází
fp16 14B váhy na kartě 24 GB nebo menší.
Jak to opravit
fp8 nebo GGUF Q4 pár, méně snímků, 480p, --lowvram; nebo 5B model.
Video je rozmazaný flek nebo barevný šum
Proč k tomu dochází
Špatný VAE (2.2 VAE s 14B nebo 2.1 VAE s 5B), nebo lightning LoRA bez CFG 1.
Jak to opravit
Použij VAE odpovídající modelu; s lightning LoRA nastav CFG 1 a 4 až 8 kroků.
Skoro žádný pohyb
Proč k tomu dochází
Prompt popisuje scénu, ne akci; nebo málo kroků u experta vysoký šum.
Jak to opravit
Přidej slovesa pohybu a pohyby kamery; dej expertovi vysoký šum polovinu kroků.
Předmět se během videa mění
Proč k tomu dochází
Příliš mnoho snímků pro rozlišení, nebo dva konfliktní LoRA.
Jak to opravit
Zkrať na 49 snímků, použij jednu motion LoRA najednou, zvyšte kroky u experta nízký šum.
Dekódování selže po úspěšném vzorkování
Proč k tomu dochází
VAE dekódování je paměťový vrchol u videa.
Jak to opravit
Wan VAE dekódování po dlaždicích (volba tiled na decode uzlu), nebo méně snímků.
Varování o nenačteném LoRA klíči
Proč k tomu dochází
2.1 LoRA na 2.2, nebo 14B LoRA na 5B model.
Jak to opravit
Použij správnou verzi a velikost; stránka modelu je pojmenovává.
AD

Bez instalace - spouštějte AI modely v cloudu
PirateDiffusion je pouze na Telegramu a je stavěný pro profesionály: tisíce modelů, LoRA a workflow ovládaných chatovými příkazy, s neomezeným generováním za pevnou cenu.
Otázky
5B nebo 14B?
5B na učení a pro karty 8 až 12 GB; 14B na kvalitu, když máš 24 GB nebo běžíš hostované. Oba používají stejné prompty.
Jak dlouhý je klip?
Až 81 snímků (5 s při 16 fps) pro 14B a 121 snímků (5 s při 24 fps) pro 5B na jeden render; delší videa se skládají z pokračování posledního snímku.
Dělá Wan zvuk?
Wan 2.2 S2V animuje mluvčího z audia, ale nevytváří zvuk;
LTX-2
a
MiniMax H3
generují zvuk s videem (jejich návody jsou na tomto webu).
Odkud jsou lightning LoRA?
Distilační vydání od Lightx2v a dalších; Wan family stránka je uvádí s heat skóre a expertem, na kterého cílí.
Můžu Wan spustit bez GPU?
Ano: PirateDiffusion z Telegramu, BitVector v prohlížeči. Oba mají workflow a LoRA předinstalované.
Odkazy a zdroje
- Wan 2.2 on GitHub
- Wan 2.2 weights on Hugging Face
- ComfyUI Wan 2.2 examples
- Wan family page
- Hosted Wan workflows on PirateDiffusion
- BitVector
Modely v tomto návodu
Napsal
Captain
Související návody
Chyby a opravy
CUDA nedostatek paměti: kolik VRAM potřebuje každý AI model a jak to zvládnout
Tabulka VRAM pro SD 1.5, SDXL, Flux, FLUX.2, Qwen-Image, Z-Image, Wan 2.2 a HunyuanVideo a techniky, které pomáhají model vměstnat: fp8 a GGUF kvantizace, odkládání na CPU, dlaždicový VAE, omezení rozlišení a počtu snímků a kdy přestat bojovat a použít hostované řešení.
Autor: Captain
2026-05-18
Chyby a opravy
Chyby ComfyUI a jak je opravit: červené uzly, chybějící modely, nedostatek paměti CUDA
Chybové zprávy ComfyUI, na které lidé narazí jako první, co každá znamená a jak ji opravit: chybějící vlastní uzly (červené rámečky), „Prompt outputs failed validation“, nedostatek paměti CUDA, špatný typ modelu v loaderu, chyby tvarů mat1 a mat2, deserializace hlavičky, nesoulad torch a xformers.
Autor: Captain
2026-05-12
Video modely
MiniMax H3 video prompts: the official structure
How MiniMax wants an H3 prompt written: the alignment line for image-anchored videos, the three core fields, shots and cuts, camera moves, speaker IDs and dialogue tags, the soundscape and the music. Condensed from the official prompt writing guide.
Autor: Captain
2026-09-14
Modely
Flux vs SDXL vs SD 1.5 vs Qwen vs Z-Image: kterou rodinu modelů používat v roce 2026
Praktické srovnání otevřených rodin obrazových modelů: sledování promptu, realismus, anime a ilustrace, vykreslování textu, rychlost, VRAM, ekosystém LoRA a licence, s doporučením pro každý druh práce a hardware.
Autor: Captain
2026-05-22
Další návody
Modely
FLUX.1 Dev: jak ho promptovat, nejlepší nastavení a kreativní nápady
Praktický průvodce FLUX.1 Dev od Black Forest Labs: promptování v přirozeném jazyce, nastavení guidance a kroků, vrstvení LoRA, vykreslování textu a nápady na prompty, které využívají jeho silné stránky.
Autor: Captain
2026-09-30
Modely
Stable Diffusion XL 1.0: promptování, nastavení a co stále umí nejlíp
Jak vytěžit maximum z oficiálního základního modelu SDXL 1.0: nativní rozlišení, nastavení CFG a sampleru, refiner, negativní prompt a nápady na styly, kde SDXL stále vyniká.
Autor: Captain
2026-10-01
Modely
Stable Diffusion 1.5: klasický model, správně promptovaný
Stable Diffusion 1.5 stojí za to znát: správné rozlišení, CFG a sampler, jak používat jeho obrovskou knihovnu LoRAs a embeddingů a kreativní nápady na prompt vhodné pro model s rozlišením 512 pixelů.
Autor: Captain
2026-10-02
Modely
FLUX.2 Dev: zadávání příkazů pro nejnovější model Black Forest Labs
FLUX.2 Dev přináší delší příkazy, lepší text, silnější realismus a úpravy s více odkazy. Tento průvodce pokrývá turbo workflow, nastavení vedení a rozlišení, strukturu příkazů a nápady, které využívají jeho nové možnosti.
Autor: Captain
2026-10-03
Modely
Qwen-Image: dlouhé prompti, perfektní text a dvoujazyčné plakáty
Qwen-Image je model, ke kterému sáhneš, když na slovech na obrázku záleží. Nauč se psát jeho dlouhé popisné prompti, přesně vykreslovat anglický a čínský text, nastavovat CFG a kroky a objevovat nápady s hodně rozvržením.
Autor: Captain
2026-09-29
Modely
SDXL-Lightning: generování ve čtyřech krocích na jakémkoli SDXL checkpointu
LoRA SDXL-Lightning od ByteDance promění 30-krokový render SDXL na 4-krokový. Nauč se, kolik kroků použít, jaké CFG nastavit, jaký sampler zvolit a jak to zkombinovat s tvými oblíbenými checkpointy a stylovými LoRA.
Autor: Captain
2026-09-30

Model
Trends
.ai
© ModelTrends.ai
|
Vyrobeno v Japonsku
|
© 2026