Model
Trends
.ai
Model
Trends
.ai
de bästa AI-modellerna med öppen källkod

Noden Load VAE i ComfyUI

Load VAE (VAELoader) laddar en fristående VAE-fil från models/vae så att en checkpoint med en saknad eller svag VAE kan avkoda rena färger, och så att split-modeller som Flux och Wan får sin decoder.
Nodpaket: ComfyUI core
Kategori: Laddare

Vad Load VAE gör

VAE omvandlar den latenta bilden till pixlar (avkodning) och pixlar till latenter (kodning). Många SD 1.5 och SDXL checkpoints har en, men vissa tränades eller slogs ihop utan och ger tråkiga, urvattnade eller fläckiga bilder. Load VAE låter dig koppla in en känd bra VAE (vae-ft-mse-840000 för SD 1.5, sdxl_vae för SDXL) istället för checkpointens VAE.
Split-modellfamiljer behöver den alltid: Flux använder ae.safetensors, Wan 2.1 använder wan_2.1_vae.safetensors, HunyuanVideo och LTX har sina egna. Utgången ersätter VAE-ledningen till VAE Decode och VAE Encode.

Ingångar

Namn
Typ
Vad det är
vae_name
COMBO
VAE-filen från models/vae. taesd och taesdxl är små förhandsvisnings-decoders.

Utgångar

Namn
Typ
Vad det är
VAE
VAE
Decoder/kodare för VAE Decode, VAE Encode och inpaint encode-noder.
AD
Hoppa över installationen: ComfyUI-arbetsflöden förinstallerade i molnet
BitVector kör färdiga ComfyUI-arbetsflöden på sina egna GPU:er. Ingen installation, inga saknade noder, inga röda rutor. Öppna det på telefonen eller datorn och generera inom en minut.

Så använder du Load VAE

  1. Ladda ner VAE för din modells familj till ComfyUI/models/vae.
  2. Lägg till Load VAE och välj filen.
  3. Koppla dess VAE-utgång till VAE Decode (och till VAE Encode om du gör img2img).
  4. Lämna checkpointens VAE-utgång okopplad.

Inställningar och tips

  • SDXL: använd fp16-fix VAE (sdxl_vae_fp16_fix) om du ser svarta bilder i fp16-läge.
  • SD 1.5 anime checkpoints ser ofta bäst ut med kl-f8-anime2 eller Orangemix VAE; realistiska med vae-ft-mse-840000.
  • Blanda aldrig familjer: en SDXL VAE på SD 1.5 latenter ger skräpfärger, en Flux VAE på SDXL latenter ger fel.
  • taesd-posterna är snabba approximationer för förhandsvisningar; slutbilder bör använda riktiga VAE.

Felsökning av Load VAE

Bilder är urvattnade, gråa eller har låg kontrast

Varför det händer
Checkpointen har ingen inbakad VAE eller en dålig, och grafen använder checkpointens VAE-utgång.

Så löser du det
Lägg till Load VAE med standard-VAE för familjen och koppla den till VAE Decode istället för checkpointens VAE.

Den avkodade bilden är en block av färgbrus

Varför det händer
VAE och latent-familjer matchar inte (t.ex. Flux ae.safetensors som avkodar SDXL latenter, eller en SDXL VAE som avkodar Wan video-latenter).

Så löser du det
Använd VAE som hör till modellen som skapade latenten. Felet "Given groups=1, weight of size ..." i konsolen bekräftar familjefel.

Svart bild efter avkodning på SDXL

Varför det händer
Original-SDXL VAE överflödar i fp16 och ger NaN-värden som avkodas till svart.

Så löser du det
Ladda sdxl_vae_fp16_fix.safetensors, eller starta ComfyUI med --fp32-vae.

VAE decode får slut på minne på stora bilder

Varför det händer
Att avkoda en 2048x2048-bild kräver flera GB för aktiveringar.

Så löser du det
Byt ut VAE Decode mot VAE Decode (Tiled) med tilesstorlek 512, eller avkoda före sista uppskalningen.

AD
Kör detta arbetsflöde från telefonen
Varje arbetsflöde på den här sidan är förinstallerat på BitVector med sina modeller och anpassade noder. Välj, skriv en prompt, klart. Noll installation, inget att ladda ner.

Frågor om Load VAE

Behöver jag alltid Load VAE?

Bara när checkpointen saknar en bra VAE eller modellen levereras utan. Många SDXL checkpoints funkar bra med sin egen.

Var hittar jag rätt VAE?

Modellsidan brukar säga det. För Flux är det ae.safetensors från Flux-repot, för Wan finns det i Wan 2.1 ompaketerade filer.

Relaterade noder

VAE Decode
ComfyUI core
VAE Decode omvandlar den samplade LATENT till en pixel-BILD med VAE; VAE Decode (Tiled) gör samma sak i kakel för väldigt stora bilder.
VAE Encode and VAE Encode (for Inpainting)
ComfyUI core
VAE Encode omvandlar en pixel-BILD till en LATENT för img2img; VAE Encode (för Inpainting) gör samma sak men suddar ut det maskade området så en inpainting-modell kan måla om det.
Load Checkpoint
ComfyUI core
Load Checkpoint (CheckpointLoaderSimple) öppnar en .safetensors- eller .ckpt-modellfil och delar upp den i de tre delar som varje arbetsflöde behöver: diffusionens MODEL, CLIP textkodare och VAE.
Load Diffusion Model
ComfyUI core
Load Diffusion Model (UNETLoader) laddar ett rent brusreduceringsnätverk som Flux, SD3.5, Wan eller HunyuanVideo från models/diffusion_models, med ett vikt_dtype-alternativ för fp8 för att spara VRAM.
AD
Trött på att laga noder? Låt molnet göra det
BitVector håller hundratals ComfyUI-arbetsflöden installerade, uppdaterade och testade på snabba moln-GPU:er. Ingen Python, inga CUDA-fel, inga VRAM-gränser. Fungerar från vilken webbläsare som helst.

Fler ComfyUI-noder

CLIP Text Encode (Prompt)
ComfyUI core
CLIP Text Encode omvandlar en textprompt till CONDITIONING med hjälp av modellens textkodare. En nod håller den positiva prompten, en annan den negativa prompten.
ComfyUI Manager
ComfyUI-Manager
ComfyUI Manager är tillägget som installerar, uppdaterar och fixar anpassade nodpaket och modeller direkt i gränssnittet, löser saknade noder i importerade arbetsflöden och sparar en ögonblicksbild av din setup.
KSampler
ComfyUI core
KSampler kör avbrusningsloopen: den tar modellen, prompts och en latent och skapar den färdiga latenta bilden, styrd av seed, steg, cfg, sampler, scheduler och denoise.
Save Image
ComfyUI core
Save Image sparar IMAGE-tensorn som en PNG i ComfyUI/output, med hela arbetsflödet inbäddat i filens metadata så att bilden kan dras tillbaka till ComfyUI för att återställa grafen.
Empty Latent Image
ComfyUI core
Empty Latent Image skapar den tomma latenta ytan (bredd, höjd, batch_size) som text-till-bild-sampling börjar från; dimensionerna måste vara multiplar av 8 och matcha modelfamiljen.
Load Image
ComfyUI core
Load Image läser in en bild från ComfyUI:s input-mapp (eller en uppladdning) och ger ut en IMAGE-tensor plus en MASK som tas från alfakanalen, startpunkten för img2img, inpainting, ControlNet och IP-Adapter-flöden.