Model
Trends
.ai
Model
Trends
.ai
بہترین اوپن سورس AI ماڈلز

ComfyUI میں Load Diffusion Model نوڈ

Load Diffusion Model (UNETLoader) ایک سادہ denoising نیٹ ورک لوڈ کرتا ہے جیسے Flux، SD3.5، Wan یا HunyuanVideo models/diffusion_models سے، جس میں weight_dtype کا آپشن ہوتا ہے تاکہ fp8 کے ذریعے VRAM بچائی جا سکے۔
نوڈ پیک: ComfyUI core
زمرہ: لوڈرز

Load Diffusion Model کیا کرتا ہے

نئے ماڈل فیملیز ایک مکمل چیک پوائنٹ کی شکل میں نہیں آتے۔ Flux، SD3.5، Wan 2.x، HunyuanVideo، LTX اور Qwen-Image ایک الگ transformer فائل کے ساتھ آتے ہیں اور الگ text encoders اور VAE ہوتے ہیں۔ Load Diffusion Model صرف transformer لوڈ کرتا ہے اور ایک MODEL آؤٹ پٹ دیتا ہے؛ text encoders DualCLIPLoader یا Load CLIP سے آتے ہیں اور VAE Load VAE سے آتا ہے۔
weight_dtype آپشن فیصلہ کرتا ہے کہ وزن میموری میں کیسے رکھے جائیں: ڈیفالٹ فائل کی اصل precision رکھتا ہے (bf16/fp16)، جبکہ fp8_e4m3fn اور fp8_e5m2 VRAM کو آدھا کر دیتے ہیں تھوڑی سی کوالٹی کی قیمت پر۔ fp8_e4m3fn_fast RTX 40 سیریز کارڈز پر تیز fp8 میٹرکس میتھ کو فعال کرتا ہے۔ GGUF quantised فائلز کے لیے الگ ComfyUI-GGUF لوڈر چاہیے۔

ان پٹس

نام
قسم
یہ کیا ہے
unet_name
COMBO
models/diffusion_models میں موجود ماڈل فائل (پرانے انسٹالز میں models/unet)۔
weight_dtype
COMBO
default، fp8_e4m3fn، fp8_e4m3fn_fast یا fp8_e5m2۔ fp8 آپشنز وزن کو 8 بٹس میں اسٹور کرتے ہیں تاکہ چھوٹے کارڈز پر فٹ ہو سکیں۔

آؤٹ پٹس

نام
قسم
یہ کیا ہے
MODEL
MODEL
denoising نیٹ ورک، LoRA لوڈرز، ModelSamplingFlux، guidance نوڈز اور KSampler کے لیے تیار۔
AD
سیٹ اپ چھوڑیں: کلاؤڈ پر پہلے سے انسٹال شدہ ComfyUI ورک فلوز
BitVector تیار شدہ ComfyUI ورک فلوز اپنے GPUs پر چلاتا ہے۔ نہ انسٹال، نہ غائب نوڈز، نہ سرخ خانے۔ اسے اپنے فون یا لیپ ٹاپ پر کھولیں اور ایک منٹ میں بنائیں۔

Load Diffusion Model کیسے استعمال کریں

  1. transformer فائل (مثلاً flux1-dev.safetensors) models/diffusion_models میں ڈاؤن لوڈ کریں۔
  2. text encoders models/text_encoders میں ڈاؤن لوڈ کریں (Flux کے لیے clip_l اور t5xxl) اور VAE models/vae میں۔
  3. Load Diffusion Model شامل کریں اور فائل منتخب کریں؛ اگر آپ کے پاس 12 GB یا کم VRAM ہے تو fp8_e4m3fn منتخب کریں۔
  4. text encoders کے لیے DualCLIPLoader اور VAE کے لیے Load VAE شامل کریں۔
  5. MODEL کو KSampler سے، CLIP کو CLIP Text Encode سے، VAE کو VAE Decode سے جوڑیں، اور latent کے لیے EmptySD3LatentImage استعمال کریں۔

سیٹنگز اور تجاویز

  • Flux Dev cfg 1.0 چاہتا ہے اور Flux Guidance تقریباً 3.5؛ عام negative prompt cfg 1 پر اثر نہیں کرتا۔
  • اگر فائل پہلے سے fp8 چیک پوائنٹ ہے تو weight_dtype کو default پر چھوڑیں؛ دوبارہ کنورٹ کرنے سے فائدہ نہیں۔
  • T5 کو بھی fp8 میں لوڈ کیا جا سکتا ہے (t5xxl_fp8_e4m3fn.safetensors) تاکہ مزید 5 GB میموری بچائی جا سکے۔
  • جب آپ LoRAs کو fine-tune یا train کر رہے ہوں تو bf16 وزن رکھیں؛ صرف جنریشن کے لیے fp8 استعمال کریں۔
  • نوڈ کا نام سالوں تک UNETLoader تھا؛ "UNET" تلاش کرنے سے یہ ابھی بھی ملتا ہے۔

Load Diffusion Model کے مسائل کا حل

ERROR: ماڈل کی قسم معلوم نہیں ہو سکی

یہ کیوں ہوتا ہے
فائل وہ diffusion transformer نہیں ہے جسے ComfyUI پہچانتا ہے (مثلاً مکمل چیک پوائنٹ، LoRA یا GGUF فائل جو diffusion_models فولڈر میں رکھی گئی ہو).

اسے کیسے ٹھیک کریں
مکمل چیک پوائنٹس Load Checkpoint سے لوڈ کریں، LoRAs Load LoRA سے اور .gguf فائلز ComfyUI-GGUF پیک کے Unet Loader (GGUF) نوڈ سے۔ اگر ماڈل فیملی آپ کے انسٹال سے نئی ہے تو ComfyUI اپ ڈیٹ کریں۔

Flux آؤٹ پٹ دھندلا یا خالص شور ہے

یہ کیوں ہوتا ہے
sampler سیٹنگز SD ورک فلو سے ہیں: cfg 1 سے زیادہ بغیر Flux Guidance کے، Empty Latent Image استعمال کرنا بجائے EmptySD3LatentImage کے، یا غلط VAE (SDXL VAE کے ساتھ Flux).

اسے کیسے ٹھیک کریں
ae.safetensors کو VAE کے طور پر استعمال کریں، EmptySD3LatentImage، cfg 1.0، sampler euler scheduler simple یا beta کے ساتھ، 20-28 steps اور Flux Guidance نوڈ 3.5 پر۔

torch.OutOfMemoryError جب 24 GB Flux فائل لوڈ کر رہے ہوں

یہ کیوں ہوتا ہے
bf16 فائل کو خود سے تقریباً 24 GB VRAM چاہیے؛ text encoder fp16 میں 10 GB مزید لیتا ہے۔

اسے کیسے ٹھیک کریں
weight_dtype کو fp8_e4m3fn پر سوئچ کریں اور t5xxl کو fp8 میں لوڈ کریں۔ 8 GB کارڈز پر GGUF Q4 یا Q5 فائل GGUF لوڈر کے ساتھ استعمال کریں اور --lowvram شامل کریں۔

fp8_e4m3fn_fast میرے GPU پر سست یا ایرر دیتا ہے

یہ کیوں ہوتا ہے
fast path کے لیے RTX 40 سیریز (Ada) یا نیا GPU اور حالیہ PyTorch چاہیے؛ پرانے کارڈز fallback کرتے ہیں یا فیل ہو جاتے ہیں۔

اسے کیسے ٹھیک کریں
RTX 30 اور پرانے کارڈز پر fp8_e4m3fn کو _fast کے بغیر منتخب کریں۔

AD
یہ ورک فلو اپنے فون سے چلائیں
اس صفحے کا ہر ورک فلو BitVector پر ماڈلز اور کسٹم نوڈز سمیت پہلے سے انسٹال ہے۔ ایک چنیں، پرامپٹ لکھیں، بس۔ صفر سیٹ اپ، کچھ ڈاؤن لوڈ نہیں۔

Load Diffusion Model کے بارے میں سوالات

فائل کہاں رکھوں، models/unet یا models/diffusion_models؟

دونوں چلتے ہیں۔ diffusion_models موجودہ نام ہے؛ unet پرانے انسٹالز کے لیے رکھا گیا ہے اور دونوں فولڈرز اسکین ہوتے ہیں۔

کیا یہ نوڈ text encoder لوڈ کرتا ہے؟

نہیں۔ اسے DualCLIPLoader (دو encoders، Flux اور SD3 کے لیے) یا Load CLIP (ایک encoder، Wan اور Hunyuan کے لیے) کے ساتھ جوڑیں۔

کیا میں Load LoRA اس کے ساتھ استعمال کر سکتا ہوں؟

ہاں۔ Load LoRA اس نوڈ سے MODEL لیتا ہے۔ Flux LoRAs جو صرف ماڈل کو patch کرتے ہیں، LoraLoaderModelOnly CLIP ان پٹ کی ضرورت کو ختم کرتا ہے۔

متعلقہ نوڈز

Load Checkpoint
ComfyUI core
Load Checkpoint (CheckpointLoaderSimple) ایک .safetensors یا .ckpt ماڈل فائل کھولتا ہے اور تین حصے دیتا ہے جو ہر ورک فلو کو چاہیے ہوتے ہیں: diffusion MODEL، CLIP ٹیکسٹ انکوڈر، اور VAE۔
DualCLIPLoader
ComfyUI core
DualCLIPLoader ایک ساتھ دو ٹیکسٹ انکوڈرز لوڈ کرتا ہے، مثلاً clip_l کے ساتھ t5xxl Flux کے لیے یا clip_g کے ساتھ t5xxl SD3 کے لیے، اور پرامپٹ نوڈز کے لیے ایک CLIP آبجیکٹ آؤٹ پٹ دیتا ہے۔
Load VAE
ComfyUI core
Load VAE (VAELoader) models/vae سے ایک الگ VAE فائل لوڈ کرتا ہے تاکہ اگر چیک پوائنٹ میں VAE غائب ہو یا کمزور ہو تو صاف رنگ نکلیں، اور اس طرح split ماڈلز جیسے Flux اور Wan کو ان کا ڈیکوڈر مل جائے۔
EmptySD3LatentImage
ComfyUI core
EmptySD3LatentImage وہ 16-چینل خالی latent بناتا ہے جو Flux، SD3 اور SD3.5 کو چاہیے ہوتا ہے؛ یہ ان ورک فلو میں Empty Latent Image کی جگہ لیتا ہے۔
Flux Guidance
ComfyUI core
Flux Guidance (FluxGuidance) وہ guidance value لکھتا ہے جو Flux Dev نے conditioning میں expect کیا ہوتا ہے، یہ cfg کی جگہ لیتا ہے؛ 3.5 default ہے اور 2 سے 5 تک کا رینج عام طور پر استعمال ہوتا ہے۔
AD
نوڈز ٹھیک کرتے کرتے تھک گئے؟ کلاؤڈ کو کرنے دیں
BitVector سینکڑوں ComfyUI ورک فلوز تیز کلاؤڈ GPUs پر انسٹال، اپ ڈیٹ اور ٹیسٹ شدہ رکھتا ہے۔ نہ Python، نہ CUDA کی خرابیاں، نہ VRAM کی حد۔ کسی بھی براؤزر سے کام کرتا ہے۔

مزید ComfyUI نوڈز

CLIP Text Encode (Prompt)
ComfyUI core
CLIP Text Encode ایک ٹیکسٹ پرامپٹ کو CONDITIONING میں بدل دیتا ہے ماڈل کے ٹیکسٹ انکوڈر کے ذریعے۔ ایک نوڈ مثبت پرامپٹ رکھتا ہے، دوسرا منفی پرامپٹ۔
ComfyUI Manager
ComfyUI-Manager
ComfyUI Manager وہ ایکسٹینشن ہے جو انٹرفیس کے اندر سے کسٹم نوڈ پیکس اور ماڈلز کو انسٹال، اپڈیٹ اور ٹھیک کرتا ہے، امپورٹ کیے گئے ورک فلو میں غائب نوڈز کو حل کرتا ہے اور آپ کی سیٹ اپ کی اسنیپ شاٹ لیتا ہے۔
KSampler
ComfyUI core
KSampler شور کم کرنے کا عمل چلاتا ہے: یہ ماڈل، پرامپٹس اور ایک latent لیتا ہے اور مکمل شدہ latent تصویر بناتا ہے، جسے seed، steps، cfg، sampler، scheduler اور denoise کے ذریعے کنٹرول کیا جاتا ہے۔
Save Image
ComfyUI core
Save Image IMAGE ٹینسر کو ComfyUI/output میں PNG کے طور پر محفوظ کرتا ہے، جس میں پورا ورک فلو فائل میٹا ڈیٹا میں شامل ہوتا ہے تاکہ تصویر کو دوبارہ ComfyUI میں گھسیٹا جا سکے اور گراف کو بحال کیا جا سکے۔
VAE Decode
ComfyUI core
VAE Decode سیمپل کیے گئے LATENT کو VAE کے ذریعے پکسل IMAGE میں تبدیل کرتا ہے؛ VAE Decode (Tiled) بہت بڑے تصاویر کے لیے ٹائلز میں یہی کام کرتا ہے۔
Empty Latent Image
ComfyUI core
Empty Latent Image ایک خالی latent کینوس بناتا ہے (چوڑائی، اونچائی، batch_size) جہاں سے text-to-image sampling شروع ہوتی ہے؛ سائز 8 کے مضارب ہونے چاہئیں اور ماڈل فیملی سے میل کھانے چاہئیں۔