Model
Trends
.ai
Model
Trends
.ai
en iyi açık kaynak yapay zeka modelleri

Wan 2.2 video: metinden videoya ve görüntüden videoya kurulum, ayarlar ve LoRA'lar

Konu: Video modelleri
Captain tarafından
2026-05-24 tarihinde yayımlandı
Share

Genel bakış

Wan 2.2
, Alibaba'nın açık video ailesi ve bu sitedeki en çok indirilen video modeli. 5B hibrit metin ve görüntüden videoya modeli olarak geliyor, tüketici kartları için tasarlandı (8 ila 12 GB'de 720p), ayrıca iki uzman kullanan 14B metinden videoya ve görüntüden videoya modelleri var: ilk adımlarda hareket ve kompozisyonu belirleyen yüksek-gürültülü model ve son adımlarda detay ekleyen düşük-gürültülü model. 14B çifti insanların paylaştığı sinematik sonuçları üretiyor; 5B modeli öğrenmek için ideal.
Topluluk yüzlerce
Wan
LoRA
'sı eğitti: kamera hareketleri (dönme, dolly, crash zoom), hareket stilleri, karakterler, efektler ve 30 adımlık renderları 4 ila 8 adıma indirip çok az kayıp yaşatan lightning / distillation LoRA'lar. Wan ailesi sayfası bunları popülerliklerine göre sıralıyor; lightning LoRA'lar neredeyse her zaman en üstte.
Barındırılan seçenekler video için iyi çünkü renderlar uzun ve
VRAM
çok kullanıyor:
PirateDiffusion
, Telegram üzerinden /wf /run ile Wan iş akışlarını çalıştırıyor,
BitVector
ise Wan grafiklerini LoRA'lar yüklü halde hazır tutuyor. İkisi de her Wan model sayfasının Çalıştır kutusunda bağlantılı.

Başvuru

Ad
Tür
Ne olduğu
Wan2.2-TI2V-5B
model
Metin ve görüntüden videoya tek model, 720p 24 fps, maksimum 121 kare. fp16 10 GB, fp8 5 GB. 8 ila 12 GB kartlar için.
Wan2.2-T2V-A14B / I2V-A14B
model pair
Yüksek-gürültülü ve düşük-gürültülü uzmanlar, her biri 14B (toplam 27B, 14B aktif). 480p ve 720p. fp8 yaklaşık 14 GB her biri; GGUF Q4 yaklaşık 8 GB her biri.
umt5-xxl text encoder
file
fp8 ölçekli (6 GB) veya fp16 (11 GB). Tüm Wan modelleri tarafından paylaşılıyor.
Wan 2.1
/ 2.2 VAE
file
5B model 2.2 VAE kullanıyor; 14B modeller 2.1 VAE kullanıyor. Karıştırmak işe yaramaz.
Resolution
setting
Hızlı testler için 480x832 veya 832x480; final için 720x1280 / 1280x720. 16'nın katları.
Frames
setting
4n+1: 33, 49, 65, 81. 16 fps'de 81 kare beş saniye.
Steps / shift /
CFG
setting
Lightning olmadan 20 ila 30 adım, shift 5 ila 8,
CFG
3.5 ila 5. Lightning LoRA'larla: 4 ila 8 adım, CFG 1, shift 5.
Lightning / distill
LoRA
Yüksek-gürültülü ve düşük-gürültülü uzmanlar için ayrı LoRA'lar; her biri kendi modeline yüklenir. Ağırlık 1.0.
Prompt
text
Sırasıyla konu, hareket, kamera, ışıklandırma, stil. Hareket fiillerini açıkça tanımla. Wan negatif prompt kullanıyor (
Flux
'tan farklı olarak).
AD
Kurulum gerekmez – yapay zeka modellerini bulutta çalıştırın
BitVector Prism başlamanın en kolay yolu: bir model seçin, bir prompt yazın ve sade bir web uygulamasında hiçbir ayar yapmadan üretin. BitVector ayrıca Discord'da ve web'de (SpyGlass) mevcuttur.

Adım adım

  1. Yükleyicileri kur:
    ComfyUI
    çekirdeği Wan 2.2'yi destekliyor; quantize dosyalar için ComfyUI-GGUF ekle. Önce ComfyUI'yi güncelle.
  2. Kartına göre indir: 8 ila 12 GB için 5B fp8 artı 2.2 VAE ve umt5 fp8; 24 GB için 14B fp8 çifti artı 2.1 VAE; 12 ila 16 GB için 14B GGUF Q4 çifti.
  3. Resmi şablonu yükle (Workflow > Browse Templates > Video > Wan 2.2) ve yükleyicileri kendi dosyalarınla değiştir. GGUF için Load Diffusion Model yerine Unet Loader (GGUF) değiştir.
  4. 14B için: iki KSampler Advanced düğümü. İlk yüksek-gürültülü modeli adım 0'dan N/2'ye kadar çalıştırır (kalan gürültü ile geri döner), ikinci düşük-gürültülü modeli N/2'den N'ye kadar çalıştırır. Şablon bunu zaten bağlıyor.
  5. İlk render: 480x832, 33 kare, 20 adım, CFG 4, shift 8, prompt "gün batımında bir plajda koşan bir corgi, kamera yanında takip ediyor, altın ışık, sığ alan derinliği". 2 ila 6 dakika sürer.
  6. Wan aile sayfasından lightning LoRA'ları ekle (her uzman için bir tane), adımları 6 yap (3 + 3), CFG 1. Renderlar 480p'de bir dakikanın altına düşer.
  7. Görüntüden videoya: I2V çiftini yükle, resmi WanImageToVideo'ya ver, promptu hareket ve kamera hakkında tut, resmi tanımlamaya çalışma.
  8. Final: 720p, 81 kare, RIFE veya FILM ile 32 fps'ye ara kare oluştur, gerekirse
    Upscalers
    ailesinden video büyütücü ile yükselt.
  9. Çok yavaş veya çok büyükse: aynı iş akışını BitVector'da veya PirateDiffusion'da /workflow /show:wan ile alanları okuyup /wf /run:wan ile promptunu çalıştır.

Örnekler

Metinden videoya prompt

A fisherman in a yellow raincoat hauls a net onto a small wooden boat in heavy rain, waves rock the boat, the camera is handheld and close, grey stormy light, cinematic, 35mm film grain
Negative: overexposed, static, blurry details, subtitles, worst quality, low quality, deformed, extra fingers, still image

Görüntüden videoya prompt (sadece hareket)

The woman turns her head toward the camera and smiles, wind moves her hair, slow push-in, soft daylight

PirateDiffusion

/workflow /show:wan-i2v
/wf /run:wan-i2v /initimage:Iabc123 the woman turns her head toward the camera and smiles, wind moves her hair, slow push-in

İpuçları

  • Hareketi fiillerle, kamerayı film terimleriyle tanımla (yavaş dolly in, elde tutulur, sabit geniş çekim). Wan kamera dilini alışılmadık şekilde iyi takip ediyor.
  • Negatif promptu koru: resmi olan aşırı pozlama, sabitlik, bulanık detaylar, altyazılar, en kötü kalite, ekstra parmaklar listelenmiş ve işe yarıyor.
  • I2V için, ilk kareyi hedef en-boy oranında Flux,
    Qwen
    veya
    Z-Image
    ile oluştur; keskin, iyi aydınlatılmış bir durağan görüntü herhangi bir prompttan daha iyi klip verir.
  • Kare sayısı çözünürlükten daha pahalı: 480p'de 81 kare, 720p'de 49 kareden daha ucuz.
  • Wan için hareket LoRA'ları hedefledikleri uzmana göre etiketlenir; sadece düşük-gürültülü LoRA detay ekler, yüksek-gürültülü LoRA hareketi değiştirir.
  • Video için seed çok önemli; promptu ayarlarken seed sabit kalmalı, sonra çekimler için değiştir.
  • LoRA setinle iş akışını şablon olarak kaydet; Wan grafikleri uzun ve kolay bozulabilir.

Sorun giderme

İlk sampler'da bellek yetersizliği

Neden olur
24 GB veya daha küçük kartta fp16 14B ağırlıkları.

Nasıl düzeltilir
fp8 veya GGUF Q4 çifti, daha az kare, 480p, --lowvram; ya da 5B model.

Video bulanık lekeler veya renk gürültüsü

Neden olur
Yanlış VAE (14B için 2.2 VAE veya 5B için 2.1 VAE), ya da lightning LoRA ile CFG 1 olmaması.

Nasıl düzeltilir
VAE'yi modele uygun yap; lightning LoRA'larla CFG 1 ve 4 ila 8 adım ayarla.

Hareket neredeyse yok

Neden olur
Prompt sahneyi anlatıyor, hareketi değil; ya da yüksek-gürültülü uzmanda çok az adım.

Nasıl düzeltilir
Hareket fiilleri ve kamera hareketleri ekle; yüksek-gürültülü uzmana adımların yarısını ver.

Konu yarı yolda değişiyor

Neden olur
Çözünürlük için çok fazla kare veya iki çelişen LoRA.

Nasıl düzeltilir
49 kareye indir, bir seferde bir hareket LoRA'sı kullan, düşük-gürültülü uzmanda adımları artır.

Sampling başarılı olduktan sonra decode başarısız

Neden olur
VAE decode video için bellek zirvesi.

Nasıl düzeltilir
Wan VAE decode'u parçalara böl (decode düğümündeki tiled seçeneği), ya da daha az kare kullan.

LoRA anahtarı yüklenmedi uyarıları

Neden olur
2.2 yerine 2.1 LoRA kullanımı, ya da 5B modelde 14B LoRA.

Nasıl düzeltilir
Versiyon ve boyutu eşleştir; model sayfası ikisini de listeliyor.

AD
PirateDiffusion
Kurulum gerekmez – yapay zeka modellerini bulutta çalıştırın
PirateDiffusion yalnızca Telegram'dadır ve profesyoneller için tasarlanmıştır: sohbet komutlarıyla çalışan binlerce model, LoRA ve iş akışı, sabit fiyatlı planda sınırsız üretim.

Sorular

5B mi yoksa 14B mi?

Öğrenmek ve 8 ila 12 GB kartlar için 5B; 24 GB varsa veya barındırılan çalıştırıyorsan kalite için 14B. İkisi de aynı promptları kullanır.

Bir klip ne kadar uzun?

14B için 81 kareye kadar (16 fps'de 5 s), 5B için 121 kareye kadar (24 fps'de 5 s) render başına; daha uzun videolar son kare devamlarıyla birleştirilir.

Wan ses yapıyor mu?

Wan 2.2 S2V sesten konuşmacıyı canlandırıyor ama ses üretmiyor;
LTX-2
ve
MiniMax H3
video ile ses üretiyor (rehberleri bu sitede).

Lightning LoRA'lar nereden geliyor?

Lightx2v ve diğerlerinin distillation sürümleri; Wan aile sayfası onları popülerlik puanları ve hedefledikleri uzmanla listeliyor.

Wan'ı GPU olmadan çalıştırabilir miyim?

Evet: Telegram'dan PirateDiffusion, tarayıcıda BitVector. İkisi de iş akışlarını ve LoRA'ları yüklü tutuyor.

Bağlantılar ve kaynaklar

Bu rehberdeki modeller

Yazan
Captain

İlgili rehberler

Hatalar ve çözümler
CUDA bellek yetersizliği: Her AI modelinin ne kadar VRAM ihtiyacı var ve nasıl sığdırılır
SD 1.5, SDXL, Flux, FLUX.2, Qwen-Image, Z-Image, Wan 2.2 ve HunyuanVideo için bir VRAM tablosu ve modeli sığdıran teknikler: fp8 ve GGUF kuantizasyonu, CPU offload, bölmeli VAE, çözünürlük ve kare sınırları, ve ne zaman mücadeleyi bırakıp barındırılan sürümü kullanmalı.
Captain tarafından
2026-05-18
Hatalar ve çözümler
ComfyUI hataları ve nasıl düzeltilir: kırmızı düğümler, eksik modeller, CUDA bellek yetersizliği
İnsanların ilk karşılaştığı ComfyUI hata mesajları, her birinin anlamı ve işe yarayan çözüm: eksik özel düğümler (kırmızı kutular), "Prompt outputs failed validation", CUDA bellek yetersizliği, yanlış model türü yükleyicide, mat1 ve mat2 şekil hataları, başlık serileştirme hatası, torch ve xformers uyumsuzlukları.
Captain tarafından
2026-05-12
Video modelleri
MiniMax H3 video istemleri: resmi yapı
MiniMax’in H3 isteminin nasıl yazılmasını istediği: görüntüye bağlı videolar için hizalama satırı, üç temel alan, çekimler ve kesmeler, kamera hareketleri, konuşmacı kimlikleri ve diyalog etiketleri, ses ortamı ve müzik. Resmi istem yazma rehberinden özetlenmiştir.
Captain tarafından
2026-09-14
Modeller
Flux vs SDXL vs SD 1.5 vs Qwen vs Z-Image: 2026'da hangi model ailesi kullanılmalı
Açık görüntü model ailelerinin pratik karşılaştırması: prompt takibi, gerçekçilik, anime ve illüstrasyon, metin işleme, hız, VRAM, LoRA ekosistemi ve lisans, her iş ve donanım türü için önerilerle.
Captain tarafından
2026-05-22

Diğer rehberler

Bulut hizmetleri
Sabit ücret mi, token mı: Graydient.ai gibi sınırsız planlar 2026'da neden AI üreticileri için en iyi seçenek
8 Ekim 2026'da kontrol edilen fiyatlarla, Graydient.ai gibi sabit ücretli sınırsız planların, Midjourney, Leonardo, fal.ai, Replicate, Runway ve Kling'in token ve kredi fiyatlandırmasına karşı sıralı maliyet karşılaştırması: Her birinde ayda 1.000 görsel ve 1.000 video gerçekten neye mal oluyor ve neden sınırsız görsel, video, ses, Grok LLM sohbeti ve web uygulamaları için tek bir sabit ücret, sürekli üretenler için en iyi değer.
Captain tarafından
2026-10-08
Modeller
FLUX.1 Dev: nasıl prompt verilir, en iyi ayarlar ve yaratıcı fikirler
Black Forest Labs tarafından geliştirilen FLUX.1 Dev için pratik bir rehber: doğal dilde prompt verme, rehberlik ve adım ayarları, LoRA yığma, metin işleme ve modelin güçlü yanlarını kullanan prompt fikirleri.
Captain tarafından
2026-09-30
Modeller
Stable Diffusion XL 1.0: istemler, ayarlar ve hala en iyi yaptığı şeyler
Resmi SDXL 1.0 temel modelinden en iyi şekilde nasıl yararlanılır: yerel çözünürlükler, CFG ve örnekleyici ayarları, rafine edici, negatif istemler ve SDXL'nin hala parladığı stil fikirleri.
Captain tarafından
2026-10-01
Modeller
Stable Diffusion 1.5: klasik model, doğru şekilde yönlendirilmiş
Stable Diffusion 1.5 hâlâ bilinmeye değer: doğru çözünürlük, CFG ve sampler, devasa LoRA ve embedding kütüphanesini nasıl kullanacağın ve 512 piksellik modele uygun yaratıcı prompt fikirleri.
Captain tarafından
2026-10-02
Modeller
FLUX.2 Dev: Black Forest Labs'in en yeni modelini yönlendirme
FLUX.2 Dev, daha uzun promptlar, daha iyi metin, daha güçlü gerçekçilik ve çoklu referans düzenleme sunuyor. Bu rehber, turbo iş akışını, rehberlik ve çözünürlük ayarlarını, prompt yapısını ve yeni özelliklerini kullanma fikirlerini kapsıyor.
Captain tarafından
2026-10-03
Modeller
Qwen-Image: uzun promptlar, mükemmel metin ve iki dilli posterler
Qwen-Image, resimdeki kelimelerin önemli olduğu durumlarda kullanacağın model. Uzun ve detaylı promptlar nasıl yazılır, İngilizce ve Çince metinler nasıl doğru şekilde oluşturulur, CFG ve adımlar nasıl ayarlanır, ayrıca yoğun düzen içeren yaratıcı fikirler nasıl keşfedilir öğren.
Captain tarafından
2026-09-29