Model
Trends
.ai
Model
Trends
.ai
de beste open source AI-modellen

AI beeld- en videogeneratie woordenlijst: 60 termen van checkpoint tot VAE, elk in één zin uitgelegd

Onderwerp: Prompten
Door Captain
Gepubliceerd op 2026-04-15
Share

Overzicht

Elke community bedenkt een eigen woordenschat en deze heeft er snel een grote bijgemaakt. De woordenlijst hieronder is de referentie waar de andere gidsen op deze site vanuit gaan; elk begrip krijgt één zin, de familie of tool waar het bij hoort als dat belangrijk is, en de langere gids om daarna te lezen. Termen zijn gegroepeerd: modellen en architecturen, bestanden, instellingen, technieken, prompting, video, hardware.
Families op deze site (
Flux
,
SDXL
,
Wan
enzovoort) worden uitgelegd op hun eigen hubpagina's, en elke modelpagina laat de termen zien die gebruikt worden: het type, de familie, de triggerwoorden, de aanbevolen instellingen. Als een woord op een modelpagina hier niet staat, is de communitychat die via de FAQ gelinkt is de plek om het te vragen.

Naslag

Naam
Type
Wat het is
Checkpoint
/ base model
file
De volledige modelgewichten in één bestand (of een paar bestanden voor Flux-tijdperk modellen). Werkt op zichzelf. Zie
checkpoint
vs
LoRA
vs embedding.
Fine-tune
model
Een checkpoint opnieuw getraind op nieuwe data (DreamShaper,
Illustrious
, Pony). Zelfde architectuur als het basismodel.
Merge
model
Een checkpoint gemaakt door anderen te middelen. Erft de familie.
LoRA
/ LyCORIS / DoRA
file
Een kleine toevoeging die het gedrag van een checkpoint verandert; heeft een triggerwoord en een gewicht nodig. Zie de LoRA-gids.
Embedding
/ textual inversion
file
Een geleerd token voor de tekstencoder, getypt met naam; vooral negatieve embeddings op
SD 1.5
en SDXL.
VAE
component
Encoder/decoder tussen pixels en latents; een verkeerde VAE geeft uitgewassen kleuren.
Text encoder (CLIP, T5, LLM)
component
Zet de prompt om in cijfers; bepaalt de prompttaal (tags vs zinnen).
U-Net / DiT / MMDiT
architecture
Het denoiserontwerp: U-Net in SD 1.5 en SDXL, diffusion transformer in Flux,
Qwen
, Wan,
Z-Image
.
MoE (mixture of experts)
architecture
Meerdere submodellen waarvan er één per stap draait (
Wan 2.2
high/low noise experts, HunyuanImage 3).
Diffusion / flow matching
training
Leren om stap voor stap ruis te verwijderen; flow matching is de rechtlijnigere formulering vanaf 2024+. Zie hoe modellen werken.
Distilled (Turbo, Lightning, Schnell, Klein, Hyper)
model
Getraind om 1-8 stappen en
CFG
1 nodig te hebben; sneller, minder flexibel.
Guidance-distilled
model
CFG ingebakken (
Flux dev
); een guidance-waarde vervangt CFG en de negatieve prompt doet niets.
fp16 / bf16 / fp8 / NF4 / GGUF Q4-Q8
precision
Hoe gewichten worden opgeslagen; lagere precisie betekent kleinere bestanden en minder
VRAM
, iets mindere kwaliteit. Zie de VRAM-gids.
format
Veilig tensor-only formaat vs code-uitvoerende pickle. Zie veilige downloads.
Steps
setting
Aantal denoising-iteraties; normaal 20-30, distilled 4-8.
CFG
scale
setting
Hoe sterk de prompt stuurt; 5-7 SDXL, 1 Flux. Zie instellingen uitgelegd.
Sampler
/ scheduler
setting
Numerieke methode en ruiscurve (Euler, DPM++ 2M; Karras, simpel, beta).
Seed
setting
De startruis; vaste seed, herhaalbaar beeld.
Denoise
setting
In
img2img
en inpainting, hoeveel van de input mag veranderen (0-1).
Shift / sigma
setting
Waar een flowmodel zijn stappen doorbrengt (Flux, Wan, Z-Image).
Latent
concept
Het gecomprimeerde werkbeeld (1/8 of 1/16 grootte) dat de denoiser bewerkt.
Resolution / native size
concept
512 (SD 1.5), 1024 (SDXL, Flux); veelvouden van 8 of 16.
Hires-fix
technique
Tweede diffusieronde op een grotere grootte tijdens generatie. Zie
upscaling
.
Upscaler
(ESRGAN, SwinIR)
technique
Pixelvergrotingsnetwerk dat na generatie draait.
technique
Genereren vanuit een bestaand beeld plus ruis. Zie img2img en inpainting.
Inpainting
/ outpainting
technique
Een gemaskeerd gebied opnieuw genereren / het canvas uitbreiden.
ControlNet
/ T2I-Adapter
technique
Structuurcontrole vanuit pose, diepte of randen. Zie
ControlNet
uitgelegd.
IP-Adapter / Redux / reference
technique
Stijl- of identiteitconditionering op basis van een afbeelding.
Face detailer / ADetailer
technique
Automatisch gezichtsmasker plus inpaint op hogere resolutie.
Tiled diffusion / Ultimate SD Upscale
technique
Grote beelden in overlappende tegels met een Tile ControlNet.
prompting
Wat je wilt tekenen / waar je vanaf wilt blijven (alleen SD en SDXL). Zie prompt basics en negatives.
Trigger word
prompting
Het token waarop een LoRA getraind is; nodig om te activeren.
Weight (word:1.3)
prompting
Aandachtsemphasis op CLIP-modellen.
Quality tags / score tags
prompting
masterpiece, best quality (Illustrious); score_9 (Pony). Alleen Anime SDXL.
Token limit (77)
prompting
CLIP chunk-grootte; reden dat lange prompts worden afgekapt op SD en SDXL.
Prompt bleeding
prompting
Een eigenschap die aan het verkeerde object blijft plakken.
T2I / T2V / I2V / TI2V / V2V
video
Tekst naar beeld / tekst naar video / beeld naar video / beide / video naar video.
Frames and fps
video
81 frames bij 16 fps is 5 seconden op Wan; geheugen schaalt mee met frames.
High-noise / low-noise expert
video
Wan 2.2's twee 14B modellen voor vroege en late stappen; LoRAs richten zich op één.
First / last frame
video
Keyframe-conditionering (FLF2V) voor gecontroleerde beweging.
VACE / Fun
ControlNet
video
Video bewerkings- en controlemodellen in de Wan-familie.
Frame interpolation (RIFE, FILM)
video
Tussenframes genereren om fps te verhogen.
VRAM
/ offloading / block swap
hardware
GPU-geheugen; delen van een model naar systeem-RAM verplaatsen als het niet past. Zie de VRAM-gids.
CUDA / MPS / ROCm
hardware
NVIDIA / Apple / AMD reken-backends.
Workflow (
ComfyUI
)
tool
Een opgeslagen knoopgrafiek; ingebed in
ComfyUI
PNG's. Zie de ComfyUI beginnersgids.
Custom node
tool
Een ComfyUI-uitbreiding; geïnstalleerd met de Manager.
Heat score
this site
Hoe populair een model nu is, op basis van downloads, runs en zoekopdrachten; uitgelegd op de FAQ-pagina.
AD
Leer door te doen, niet door te lezen
BitVector Prism labelt zijn instellingen met dezelfde woorden als deze woordenlijst en laadt per model de juiste waarden vooraf. Open het naast deze pagina en probeer elk begrip op een echt beeld. Geen installatie.

Stap voor stap

  1. Lees een modelpagina van boven naar beneden met de woordenlijst open: type, familie, triggerwoorden, instellingenregel onder elk voorbeeld.
  2. Kies de drie termen die je verwarrend vond en lees de gelinkte gids voor elk; de gidsen zijn zo geschreven dat deze woordenlijst genoeg context geeft.
  3. Als je een nieuw woord tegenkomt in een forumthread, kijk dan of het een bestand, een instelling, een techniek of een videoterm is; de meeste verwarring komt door die categorieën te mengen.
  4. Kom terug als er een nieuwe familie verschijnt; de hubpagina's voegen hun eigen termen toe (Wan 2.2 experts, Flux guidance) en deze lijst wordt bijgewerkt.

Voorbeelden

Een instellingenregel van een modelpagina, uitgelegd

"<lora:zavy-cinematic-xl:0.7> zavy cinematic, ... | 1024x1024 | DPM++ 2M Karras | 28 steps | CFG 6 | seed 4471"
LoRA at weight 0.7 with its trigger word; native SDXL size; sampler + scheduler; 28 denoising steps; CFG 6; fixed seed

Een Wan 2.2 workflownaam, uitgelegd

wan2.2_i2v_high_noise_14B_fp8_scaled.safetensors -> Wan 2.2, image to video, the high-noise expert, 14B parameters, fp8 precision, safetensors format

Tips

  • Drie woorden veroorzaken de meeste beginnersfouten: familie (een LoRA moet erbij passen), triggerwoord (een LoRA heeft het nodig) en denoise (img2img leeft of sterft eraan).
  • Als twee gidsen het niet eens zijn over CFG, hebben ze het over verschillende families; check welke.
  • "Model" betekent meestal checkpoint in de meeste zinnen, maar op deze site is "model" elk catalogusitem inclusief LoRAs; het type-label vertelt je welke.
  • Videotermen zijn dezelfde ideeën met een tijdas; als je T2I en img2img kent, ken je T2V en I2V.
  • De cloudpartners gebruiken dezelfde woordenschat:
    PirateDiffusion
    's flags zijn /steps, /guidance, /seed, /size;
    BitVector
    's paneel gebruikt dezelfde namen.

Probleemoplossing

Twee bronnen gebruiken hetzelfde woord anders

Waarom het gebeurt
Termen verschilden tussen SD 1.5, SDXL en Flux periodes ("guidance" vs "CFG").

Zo los je het op
Koppel aan de familie: CFG voor SD/SDXL, guidance voor Flux.

"Model" op Civitai betekent iets anders dan hier

Waarom het gebeurt
Civitai groepeert versies onder één model; deze site toont elke versie apart.

Zo los je het op
Match op hash, niet op naam.

Een instelling genoemd op een modelpagina ontbreekt in mijn UI

Waarom het gebeurt
Verschillende UI-namen (denoising strength vs denoise; hires steps vs second pass).

Zo los je het op
De woordenlijstregel geeft de aliassen; de ComfyUI node-gids koppelt knoopnamen.

AD
PirateDiffusion
Elk begrip is een commando
PirateDiffusion zet de woordenschat om in Telegram-flags: /steps, /guidance, /seed, /size, LoRA-tags en [[negatives]]. Duizenden modellen, onbeperkt renderen, vaste prijs.

Vragen

Is een checkpoint hetzelfde als een model?

In dagelijks gebruik wel. Strikt genomen is een checkpoint het opgeslagen bestand van een model.

Wat is het verschil tussen guidance en CFG?

CFG is classifier-free guidance die tijdens runtime wordt toegepast op SD en SDXL; Flux dev heeft het ingebakken en toont één enkele guidance-waarde.

Waar zijn de videospecifieke woorden?

In de videogroep hierboven en op de Wan-, LTX- en H3-familiepagina's; de video startgids loopt ze door.

Moet ik dit allemaal weten om beelden te maken?

Nee. Familie, triggerwoord en denoise dekken 80 procent van de problemen; de rest leer je als je het tegenkomt.

Links en bronnen

Modellen in deze gids

Geschreven door
Captain

Verwante gidsen

Clouddiensten
Aan de slag met AI-beeldgeneratie: je eerste afbeelding in tien minuten
Een eenvoudige start voor absolute beginners: wat een model is, de drie manieren om er een te gebruiken (webapp, chatbot, je eigen pc), hoe je een eerste prompt schrijft, wat de instellingen betekenen en hoe je een goed resultaat herkent ten opzichte van geluk.
Door Captain
2025-08-14
Modellen
Hoe generatieve AI-beeldmodellen werken: diffusie, latents en tekstencoders eenvoudig uitgelegd
De werking achter Stable Diffusion, SDXL, Flux en de videomodellen zonder de wiskunde: wat ruis ermee te maken heeft, waarom modellen in een gecomprimeerde latente ruimte werken, wat de tekstencoder en VAE doen, wat stappen en begeleiding echt veranderen, en waarom trainingsdata bepaalt wat een model kan tekenen.
Door Quartermaster
2025-08-28
Modellen
Checkpoint vs LoRA vs embedding vs ControlNet: welk bestand doet wat
De zes soorten modelfiles die je tegenkomt, wat elk verandert, hoe groot ze zijn, waar ze horen en wanneer je ze gebruikt: checkpoints en fine-tunes, LoRAs en hun LyCORIS neefjes, textual inversion embeddings, ControlNets en IP-Adapters, VAEs en upscalers.
Door Quartermaster
2025-10-08
Prompten
Stappen, CFG, samplers, schedulers en seeds: de generatie-instellingen uitgelegd met veilige standaardwaarden
Wat elke instelling in het generatiepaneel verandert, welke waarden werken per modelfamilie (SD 1.5, SDXL, Flux, Qwen, Z-Image, Wan), welke samplers de moeite waard zijn om te kennen, waarom gedistilleerde modellen de gewone regels breken, en hoe je seeds gebruikt om steeds één ding tegelijk te veranderen.
Door Quartermaster
2025-11-19
Videomodellen
AI-video maken voor beginners: van afbeelding naar video, tekst naar video en de eerste clip met Wan, LTX-2 en H3
Een eerste week met open video modellen: het verschil tussen tekst-naar-video en afbeelding-naar-video en waarom je met dat laatste moet beginnen, de drie modelgroepen die het leren waard zijn (Wan 2.2, LTX-2, MiniMax H3), aantal frames en resoluties die werken, hoe je een bewegingsprompt schrijft, wat je kunt verwachten van een 16 of 24 GB kaart versus de cloud, en hoe je clips van vijf seconden langer maakt.
Door Lookout
2026-04-29

Meer gidsen

Clouddiensten
Vaste prijs versus tokens: waarom onbeperkte plannen zoals Graydient.ai de beste waarde bieden voor AI-makers in 2026
Een gerangschikte kostenvergelijking, met prijzen gecontroleerd op 8 oktober 2026, van vaste prijs onbeperkte plannen zoals Graydient.ai tegenover token- en creditprijzen van Midjourney, Leonardo, fal.ai, Replicate, Runway en Kling: wat 1.000 afbeeldingen en 1.000 video's per maand echt kosten bij elk, en waarom één vaste prijs voor onbeperkte afbeeldingen, video, audio, Grok LLM chat en webapps de beste waarde is voor makers die veel experimenteren.
Door Captain
2026-10-08
Modellen
FLUX.1 Dev: hoe je het aanstuurt, beste instellingen en creatieve ideeën
Een praktische gids voor FLUX.1 Dev van Black Forest Labs: natuurlijk-taal prompts, begeleiding en stapinstellingen, LoRA stapeling, tekstweergave en promptideeën die goed werken met dit model.
Door Captain
2026-09-30
Modellen
Stable Diffusion XL 1.0: prompts, instellingen en waar het nog steeds het beste in is
Hoe je het meeste haalt uit het officiële SDXL 1.0 basismodel: native resoluties, CFG- en sampler-instellingen, de refiner, negatieve prompts en ideeën voor stijlen waarin SDXL nog steeds uitblinkt.
Door Captain
2026-10-01
Modellen
Stable Diffusion 1.5: het klassieke model, goed aangestuurd
Stable Diffusion 1.5 is nog steeds de moeite waard om te kennen: de juiste resolutie, CFG en sampler, hoe je de enorme bibliotheek met LoRAs en embeddings gebruikt, en creatieve promptideeën die passen bij een 512-pixel model.
Door Captain
2026-10-02
Modellen
FLUX.2 Dev: prompten met het nieuwste model van Black Forest Labs
FLUX.2 Dev brengt langere prompts, betere tekst, sterkere realisme en multi-reference bewerking. Deze gids behandelt de turbo workflow, guidance en resolutie-instellingen, promptstructuur en ideeën die gebruikmaken van de nieuwe mogelijkheden.
Door Captain
2026-10-03
Modellen
Qwen-Image: lange prompts, perfecte tekst en tweetalige posters
Qwen-Image is het model dat je moet gebruiken als de woorden in de afbeelding belangrijk zijn. Leer hoe je lange, beschrijvende prompts schrijft, Engelse en Chinese tekst nauwkeurig weergeeft, CFG en stappen instelt, en creatieve ideeën met veel lay-out onderzoekt.
Door Captain
2026-09-29