Model
Trends
.ai
Model
Trends
.ai
de beste open source AI-modellen

Checkpoint vs LoRA vs embedding vs ControlNet: welk bestand doet wat

Onderwerp: Modellen
Door Quartermaster
Gepubliceerd op 2025-10-08
Share

Overzicht

Een nieuwe gebruiker downloadt een "model" en ontdekt dat het één van zes verschillende dingen is die in zes verschillende mappen horen en zes verschillende taken doen. De catalogus op deze site labelt elke vermelding met het type (basismodel,
LoRA
, embedding, ander) en de familie om die reden. Deze gids legt de types één keer uit, zodat de labels logisch zijn.
De vuistregel: een checkpoint is de hele schilder; een LoRA leert de schilder een nieuw onderwerp of stijl; een embedding leert de schilder een nieuw woord; een
ControlNet
of IP-Adapter vertelt de schilder waar dingen horen of wat hij moet kopiëren van een referentie; de VAE zijn de ogen van de schilder die tussen het doek en de gecomprimeerde werkruimte schakelen; een
upscaler
is een aparte vakman die het afgewerkte plaatje vergroot. Alleen de checkpoint kan zelfstandig werken. Alles wat anders is, heeft een checkpoint van dezelfde familie nodig.
De grootte zegt veel. 2 tot 7 GB voor een
SDXL
checkpoint en 12 tot 24 GB voor
Flux
; 10 tot 700 MB voor een LoRA; minder dan 1 MB voor een embedding; 1 tot 2,5 GB voor een ControlNet; 300 MB voor een VAE; 60 MB voor een ESRGAN upscaler. Als een bestand dat LoRA heet 6 GB is, is het een checkpoint. De modelpagina hier toont de grootte en de hash zodat je het kunt zien voor je downloadt.

Naslag

Naam
Type
Wat het is
Checkpoint (basismodel)
2-24 GB
De volledige denoiser, meestal met tekstencoder en VAE erbij. Fine-tunes (DreamShaper, Juggernaut,
Illustrious
, Pony) zijn checkpoints die opnieuw getraind zijn op nieuwe data. Map: models/checkpoints (
ComfyUI
), models/Stable-diffusion (A1111,
Forge
). Flux,
Qwen
en
Wan
leveren aparte diffusion_models + text_encoders + vae bestanden.
10-700 MB
Een klein verschil in gewichten dat bovenop een checkpoint wordt toegepast. Personages, stijlen, concepten, sliders, beweging. Heeft een triggerwoord en een gewicht nodig. Map: models/loras of models/Lora.
LyCORIS / LoCon / LoHa / DoRA
10-700 MB
LoRA-varianten die meer lagen raken of een andere factorisatie gebruiken. Worden geladen als LoRAs in elke huidige UI.
Embedding (textual inversion)
10-200 KB
Een geleerd token voor de tekstencoder. Wordt in de prompt opgeroepen met de bestandsnaam. Veel gebruikt als negatieve embeddings (bad-hands, easynegative) op
SD 1.5
en SDXL; zeldzaam op Flux. Map: models/embeddings.
ControlNet
/ T2I-Adapter
0.3-2.5 GB
Een zijnetwerk dat de denoiser conditioneert op een pose, dieptemap, randkaart of schets. Familie-specifiek. Map: models/controlnet.
IP-Adapter / reference
50 MB-1 GB
Conditioneert op een afbeelding in plaats van tekst: stijltransfer, gezichtsreferentie. Heeft een bijpassend CLIP vision model nodig.
VAE
160-330 MB
Encoder/decoder tussen pixels en latents. Meestal meegeleverd in checkpoints; losse bestanden fixen vervaagde kleuren (SDXL fp16-fix) of horen bij nieuwe families (Flux ae.safetensors, Wan VAE).
2-70 MB
ESRGAN, Real-ESRGAN, SwinIR, DAT: aparte netwerken die pixels vergroten na generatie. Map: models/upscale_models.
AD
Geen mappen, geen bestandstypes, geen VAE-zoektocht
BitVector Prism laadt het checkpoint, de LoRAs, de VAE en de ControlNets die bij elkaar horen vooraf. Kies een model van deze site, kies een add-on en genereer in de browser.

Stap voor stap

  1. Herken het bestandstype aan het label in de catalogus en de grootte voor je downloadt. Basismodel, LoRA, embedding of ander op de kaart; het precieze aantal bytes op de modelpagina.
  2. Match de familie. Elk bestand dat geen checkpoint is, noemt de familie waarvoor het gemaakt is (SDXL, Flux,
    Wan 2.2
    14B); het werkt alleen met checkpoints van die familie.
  3. Zet het bestand in de map voor het type (zie tabel hierboven) en vernieuw de UI.
  4. Checkpoint: selecteer het als model. Voor gesplitste families (Flux, Qwen, Wan,
    Z-Image
    ) laad je het diffusion model, de tekstencoders en de VAE apart in ComfyUI.
  5. LoRA: laad de LoRA-node na de checkpoint, of <lora:name:0.8> in de prompt, plus het triggerwoord.
  6. Embedding: typ de bestandsnaam in de prompt (of in de negatieve prompt voor negatieve embeddings); ComfyUI gebruikt embedding:name.
  7. ControlNet: pas de ControlNet-node toe met de voorbewerkte afbeelding (pose, diepte); begin met sterkte 0.8 en eindpercentage 0.8.
  8. VAE en upscaler: selecteer de VAE in de loader of instellingen als de kleuren niet kloppen; voer de upscaler als laatste stap uit via Upscale Image (met Model).

Voorbeelden

Een volledige SDXL stack in een Forge prompt

Checkpoint: juggernautXL_v9.safetensors | VAE: sdxl_vae_fp16fix.safetensors
Prompt: zavy cinematic, <lora:zavy-cinematic-xl:0.7> a knight resting by a campfire, night, embers, 35mm
Negative: easynegative, bad-hands-5, blurry | ControlNet: openpose, weight 0.8 | Upscaler: 4x-UltraSharp 2x

Dezelfde stack als ComfyUI nodes

Load Checkpoint -> Load LoRA -> Apply ControlNet (OpenPose image) -> KSampler -> VAE Decode (fp16-fix VAE) -> Upscale Image (using Model: 4x-UltraSharp)

Tips

  • Het catalogustype "ander" omvat ControlNets, VAEs,
    upscalers
    en workflows; de modelpagina zegt welke.
  • Merges zijn checkpoints gemaakt door andere checkpoints te middelen; ze erven de familie van hun ouders en behouden LoRA-compatibiliteit.
  • Een
    inpainting
    checkpoint is een checkpoint met extra inputkanalen; het heeft de inpainting workflow nodig en is geen drop-in voor text-to-image.
  • Negatieve embeddings waren de SD 1.5 manier om handen te fixen; op SDXL helpen ze minder en op Flux doen ze niks omdat het model geen
    CFG
    negatief heeft.
  • Flux Fill, Flux Redux, Flux Depth en Canny zijn checkpoints of adapters, geen LoRAs, ook al staan ze naast de LoRAs op de hub.
  • Als je twijfelt, hebben de cloudpartners de juiste combinatie al geladen: kies het model en de LoRA en de bijpassende VAE en ControlNet worden voor je geregeld.

Probleemoplossing

Downloadde een "LoRA" en het is 6 GB

Waarom het gebeurt
Het is een checkpoint; de uploader heeft het losjes gelabeld.

Zo los je het op
Zet het in de checkpoints map en selecteer het als model. Het cataloguslabel hier is betrouwbaar.

Embedding doet niks

Waarom het gebeurt
Verkeerde familie (SD 1.5 embedding op SDXL), of de getypte naam komt niet overeen met de bestandsnaam.

Zo los je het op
Match de familie; typ de exacte bestandsnaam zonder extensie; in ComfyUI gebruik embedding:name.

ControlNet geeft ruis of negeert de pose

Waarom het gebeurt
ControlNet voor een andere familie, of de ruwe foto werd gebruikt in plaats van de voorbewerkte kaart.

Zo los je het op
Gebruik de ControlNet die voor de checkpoint familie is gemaakt en start eerst de preprocessor node.

Kleuren zien er vervaagd uit

Waarom het gebeurt
Ontbrekende of verkeerde VAE.

Zo los je het op
Laad de VAE van de familie; op SDXL de fp16-fix VAE.

Model laadt maar genereert zwarte beelden

Waarom het gebeurt
fp16 overflow in de VAE of een checkpoint die --no-half-vae nodig heeft.

Zo los je het op
Gebruik de fp16-fix VAE of de no-half-vae vlag; op Flux check dat de precisie van de tekstencoder klopt met de build.

AD
PirateDiffusion
Checkpoints, LoRAs, embeddings en ControlNets, al verbonden
PirateDiffusion houdt duizenden modelfiles georganiseerd voor je op zijn eigen GPU's; je noemt het checkpoint en de LoRA-tags in een Telegram-commando en de bijpassende VAE en ControlNets worden toegepast. Onbeperkt genereren, vaste prijs.

Vragen

Welke moet een beginner eerst downloaden?

Een checkpoint van de familie die je wilt gebruiken. LoRAs komen daarna, als je weet welke basis je fijn vindt. Embeddings en ControlNets komen als een specifiek probleem ze nodig heeft.

Kan ik een LoRA in een checkpoint mergen?

Ja, elke UI heeft een merge tool, en het resultaat is een nieuw checkpoint. Het bespaart een node maar bevriest het gewicht; de meeste mensen houden LoRAs apart.

Is een fine-tune hetzelfde als een LoRA?

Nee. Een fine-tune traint het hele checkpoint opnieuw (gigabytes); een LoRA is een kleine toevoeging (megabytes). Veel fine-tunes begonnen als LoRAs die gemerged werden.

Gebruiken Flux en Qwen embeddings?

Praktisch nooit. Hun LLM tekstencoders zijn niet zo getraind; stijl- en conceptwerk gebeurt met LoRAs.

Wat is een workflow bestand?

Een ComfyUI JSON die deze onderdelen aan elkaar knoopt. De catalogus noemt sommige "ander"; ze bevatten geen gewichten, alleen het recept.

Links en bronnen

Modellen in deze gids

Geschreven door
Quartermaster

Verwante gidsen

Modellen
Wat is een LoRA en hoe gebruik je er een in ComfyUI, Forge, Automatic1111 en in de cloud
LoRAs uitgelegd voor mensen die resultaten willen, geen wiskunde: wat een LoRA-bestand verandert, waarom het bij de familie van het basismodel moet passen, triggerwoorden, gewichten, meerdere LoRAs stapelen, de map en syntaxis voor elke UI, en hoe je een LoRA in de cloud kunt proberen voordat je iets downloadt.
Door Captain
2026-05-20
Apps
Hoe installeer je een LoRA: mappen, bestandcontroles en eerste gebruik in ComfyUI, Forge, Automatic1111 en Draw Things
De praktische installatiehandleiding: waar je een LoRA kunt downloaden, hoe je de bestands-hash controleert aan de hand van de modelpagina, in welke map het moet voor elke populaire UI, hoe je de lijst ververst, hoe je het voor het eerst laadt, en de drie manieren om er een in de cloud te gebruiken zonder iets te installeren.
Door Lookout
2025-09-24
Modellen
Hoe generatieve AI-beeldmodellen werken: diffusie, latents en tekstencoders eenvoudig uitgelegd
De werking achter Stable Diffusion, SDXL, Flux en de videomodellen zonder de wiskunde: wat ruis ermee te maken heeft, waarom modellen in een gecomprimeerde latente ruimte werken, wat de tekstencoder en VAE doen, wat stappen en begeleiding echt veranderen, en waarom trainingsdata bepaalt wat een model kan tekenen.
Door Quartermaster
2025-08-28
Prompten
ControlNet uitgelegd: pose, diepte, randen en referentiebeelden voor SD 1.5, SDXL en Flux
Hoe ControlNet een model een pose, een dieptekaart, een randtekening of een krabbel laat volgen in plaats van de compositie te raden op basis van de prompt: de meest gebruikte controletype en wanneer je ze gebruikt, de preprocessorstap, instellingen voor sterkte en eindpercentage, de familie-specifieke bestanden en de Flux-tijdperk alternatieven (Flux Depth, Canny, Kontext).
Door Captain
2026-02-18
Modellen
AI-afbeeldingen opschalen: ESRGAN-modellen, hires-fix, tiled diffusion en wanneer je welke gebruikt
De drie soorten opschalen en waar ze voor zijn: snelle pixel-upscalers (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) voor schone vergroting, hires-fix om detail toe te voegen tijdens het genereren, en tiled diffusion (Ultimate SD Upscale, SUPIR, Flux-gebaseerd) om een 1024-render om te zetten in een gedetailleerde 4K-print; met denoise-waarden, tegelgroottes en de modellen die het downloaden waard zijn.
Door Quartermaster
2026-03-04

Meer gidsen

Clouddiensten
Vaste prijs versus tokens: waarom onbeperkte plannen zoals Graydient.ai de beste waarde bieden voor AI-makers in 2026
Een gerangschikte kostenvergelijking, met prijzen gecontroleerd op 8 oktober 2026, van vaste prijs onbeperkte plannen zoals Graydient.ai tegenover token- en creditprijzen van Midjourney, Leonardo, fal.ai, Replicate, Runway en Kling: wat 1.000 afbeeldingen en 1.000 video's per maand echt kosten bij elk, en waarom één vaste prijs voor onbeperkte afbeeldingen, video, audio, Grok LLM chat en webapps de beste waarde is voor makers die veel experimenteren.
Door Captain
2026-10-08
Modellen
FLUX.1 Dev: hoe je het aanstuurt, beste instellingen en creatieve ideeën
Een praktische gids voor FLUX.1 Dev van Black Forest Labs: natuurlijk-taal prompts, begeleiding en stapinstellingen, LoRA stapeling, tekstweergave en promptideeën die goed werken met dit model.
Door Captain
2026-09-30
Modellen
Stable Diffusion XL 1.0: prompts, instellingen en waar het nog steeds het beste in is
Hoe je het meeste haalt uit het officiële SDXL 1.0 basismodel: native resoluties, CFG- en sampler-instellingen, de refiner, negatieve prompts en ideeën voor stijlen waarin SDXL nog steeds uitblinkt.
Door Captain
2026-10-01
Modellen
Stable Diffusion 1.5: het klassieke model, goed aangestuurd
Stable Diffusion 1.5 is nog steeds de moeite waard om te kennen: de juiste resolutie, CFG en sampler, hoe je de enorme bibliotheek met LoRAs en embeddings gebruikt, en creatieve promptideeën die passen bij een 512-pixel model.
Door Captain
2026-10-02
Modellen
FLUX.2 Dev: prompten met het nieuwste model van Black Forest Labs
FLUX.2 Dev brengt langere prompts, betere tekst, sterkere realisme en multi-reference bewerking. Deze gids behandelt de turbo workflow, guidance en resolutie-instellingen, promptstructuur en ideeën die gebruikmaken van de nieuwe mogelijkheden.
Door Captain
2026-10-03
Modellen
Qwen-Image: lange prompts, perfecte tekst en tweetalige posters
Qwen-Image is het model dat je moet gebruiken als de woorden in de afbeelding belangrijk zijn. Leer hoe je lange, beschrijvende prompts schrijft, Engelse en Chinese tekst nauwkeurig weergeeft, CFG en stappen instelt, en creatieve ideeën met veel lay-out onderzoekt.
Door Captain
2026-09-29