Model
Trends
.ai
Model
Trends
.ai
nejlepší open source AI modely

Checkpoint vs LoRA vs embedding vs ControlNet: co který soubor dělá

Téma: Modely
Autor: Quartermaster
Publikováno 2025-10-08
Šest typů modelových souborů, na které narazíš, co každý mění, jak je velký, kam patří a kdy ho použít: checkpointy a fine-tuny, LoRA a jejich příbuzní LyCORIS, textové inverzní embeddingy, ControlNety a IP-Adaptery, VAE a upscalery.

Přehled

Nový uživatel si stáhne „model“ a zjistí, že je to jedna ze šesti různých věcí, které patří do šesti různých složek a mají šest různých úkolů. Katalog na tomto webu proto u každé položky uvádí její typ (základní model,
LoRA
, embedding, jiné) a rodinu. Tento průvodce vysvětluje typy jednou, aby ty štítky dávaly smysl.
Základní pravidlo: checkpoint je celý malíř; LoRA naučí malíře nový motiv nebo styl; embedding naučí malíře nové slovo;
ControlNet
nebo IP-Adapter říká malíři, kam co patří nebo co má zkopírovat z reference; VAE jsou malířovy oči, které převádějí mezi plátnem a komprimovaným pracovním prostorem;
upscaler
je samostatný řemeslník, který zvětšuje hotový obrázek. Jen checkpoint může fungovat samostatně. Vše ostatní potřebuje checkpoint ze stejné rodiny.
Velikosti hodně napoví. 2 až 7 GB pro
SDXL
checkpoint a 12 až 24 GB pro
Flux
; 10 až 700 MB pro LoRU; pod 1 MB pro embedding; 1 až 2,5 GB pro ControlNet; 300 MB pro VAE; 60 MB pro ESRGAN upscaler. Pokud je soubor označený jako LoRA a má 6 GB, je to checkpoint. Stránka modelu tady ukazuje velikost a hash, takže to poznáš před stažením.

Reference

Název
Typ
Co to je
Checkpoint (base model)
2-24 GB
Celý denoiser, obvykle s textovým enkodérem a VAE v jednom balíčku. Fine-tuny (DreamShaper, Juggernaut,
Illustrious
, Pony) jsou checkpointy přetrénované na nových datech. Složka: models/checkpoints (
ComfyUI
), models/Stable-diffusion (A1111,
Forge
). Flux,
Qwen
a
Wan
mají oddělené diffusion_models + text_encoders + vae soubory.
LoRA
10-700 MB
Malý rozdíl vah aplikovaný na checkpoint. Postavy, styly, koncepty, slidery, pohyb. Potřebuje trigger slovo a váhu. Složka: models/loras nebo models/Lora.
LyCORIS / LoCon / LoHa / DoRA
10-700 MB
Varianty LoRA, které zasahují do více vrstev nebo používají jinou faktorizaci. Načítají se jako LoRA ve všech současných UI.
Embedding (textual inversion)
10-200 KB
Naučený token pro textový enkodér. V promptu se volá podle názvu souboru. Běžné jako negativní embeddingy (bad-hands, easynegative) na
SD 1.5
a SDXL; vzácné na Flux. Složka: models/embeddings.
ControlNet / T2I-Adapter
0.3-2.5 GB
Vedlejší síť, která podmiňuje denoiser podle pózy, hloubkové mapy, okrajové mapy nebo náčrtu. Specifická pro rodinu. Složka: models/controlnet.
IP-Adapter / reference
50 MB-1 GB
Podmiňuje podle obrázku místo textu: přenos stylu, reference obličeje. Potřebuje odpovídající CLIP vision model.
VAE
160-330 MB
Enkoder/dekoder mezi pixely a latentními proměnnými. Obvykle součást checkpointů; samostatné soubory opravují vybledlé barvy (SDXL fp16-fix) nebo jsou součástí nových rodin (Flux ae.safetensors, Wan VAE).
Upscaler
2-70 MB
ESRGAN, Real-ESRGAN, SwinIR, DAT: samostatné sítě, které zvětšují pixely po generování. Složka: models/upscale_models.
AD
Žádné složky, žádné typy souborů, žádné hledání VAE
BitVector Prism přednačítá checkpoint, LoRA, VAE a ControlNety, které k sobě patří. Vyber model z tohoto webu, přidatek a generuj v prohlížeči.

Krok za krokem

  1. Zjisti typ souboru podle štítku v katalogu a velikosti před stažením. Základní model, LoRA, embedding nebo jiné na kartě; přesné bajty na stránce modelu.
  2. Slaď rodinu. Každý soubor kromě checkpointu uvádí rodinu, pro kterou byl vytvořen (SDXL, Flux,
    Wan 2.2
    14B); funguje jen s checkpointy téže rodiny.
  3. Dej soubor do složky podle jeho typu (tabulka výše) a obnov UI.
  4. Checkpoint: vyber ho jako model. U rozdělených rodin (Flux, Qwen, Wan,
    Z-Image
    ) načti diffusion model, textové enkodéry a VAE zvlášť v ComfyUI.
  5. LoRA: načti LoRA uzel za checkpointem, nebo <lora:name:0.8> v promptu, plus trigger slovo.
  6. Embedding: napiš název souboru v promptu (nebo v negativním promptu pro negativní embeddingy); ComfyUI používá embedding:name.
  7. ControlNet: použij ControlNet uzel s předzpracovaným obrázkem (póza, hloubka); začni s intenzitou 0.8 a koncovým procentem 0.8.
  8. VAE a upscaler: vyber VAE v loaderu nebo nastavení, když jsou barvy špatné; spusť upscaler jako poslední krok přes Upscale Image (používá Model).

Příklady

Plná SDXL sestava v promptu Forge

Checkpoint: juggernautXL_v9.safetensors | VAE: sdxl_vae_fp16fix.safetensors
Prompt: zavy cinematic, <lora:zavy-cinematic-xl:0.7> a knight resting by a campfire, night, embers, 35mm
Negative: easynegative, bad-hands-5, blurry | ControlNet: openpose, weight 0.8 | Upscaler: 4x-UltraSharp 2x

Stejná sestava jako uzly v ComfyUI

Load Checkpoint -> Load LoRA -> Apply ControlNet (OpenPose image) -> KSampler -> VAE Decode (fp16-fix VAE) -> Upscale Image (using Model: 4x-UltraSharp)

Tipy

  • Typ katalogu „jiné“ zahrnuje ControlNety, VAE, upscalery a workflow; stránka modelu říká, co přesně.
  • Mergy jsou checkpointy vytvořené zprůměrováním jiných checkpointů; dědí rodinu svých rodičů a zachovávají kompatibilitu s LoRA.
  • Inpainting
    checkpoint je checkpoint s extra vstupními kanály; potřebuje inpainting workflow a není to plug-and-play pro text-to-image.
  • Negativní embeddingy byly způsob, jak na SD 1.5 opravit ruce; na SDXL pomáhají méně a na Flux nefungují, protože model nemá
    CFG
    negativní.
  • Flux Fill, Flux Redux, Flux Depth a Canny jsou checkpointy nebo adaptéry, ne LoRA, i když jsou vedle LoRA na hubu.
  • Když si nejsi jistý, cloudoví partneři mají správnou kombinaci přednastavenou: vyber model a LoRA a odpovídající VAE a ControlNet se nastaví automaticky.

Řešení problémů

Stáhl jsi „LoRA“ a má 6 GB

Proč k tomu dochází
Je to checkpoint; uploader ho označil volně.

Jak to opravit
Dej ho do složky checkpoints a vyber jako model. Štítek v katalogu tady je spolehlivý.

Embedding nic nedělá

Proč k tomu dochází
Špatná rodina (embedding SD 1.5 na SDXL) nebo jméno v promptu neodpovídá názvu souboru.

Jak to opravit
Slaď rodinu; napiš přesný název souboru bez přípony; v ComfyUI použij embedding:name.

ControlNet dělá šum nebo ignoruje pózu

Proč k tomu dochází
ControlNet pro jinou rodinu, nebo místo předzpracované mapy byl použit surový foto.

Jak to opravit
Použij ControlNet pro rodinu checkpointu a nejdřív spusť preprocessor uzel.

Barvy vypadají vybledle

Proč k tomu dochází
Chybí nebo je špatný VAE.

Jak to opravit
Načti VAE rodiny; na SDXL fp16-fix VAE.

Model se načte, ale generuje černé obrázky

Proč k tomu dochází
fp16 přetečení ve VAE nebo checkpoint, který potřebuje --no-half-vae.

Jak to opravit
Použij fp16-fix VAE nebo flag no-half-vae; u Flux zkontroluj, že přesnost textového enkodéru odpovídá buildu.

AD
PirateDiffusion
Checkpointy, LoRA, embeddingy a ControlNety, už propojené
PirateDiffusion má tisíce modelových souborů uspořádaných na svých GPU; zadáš checkpoint a LoRA tagy v Telegram příkazu a odpovídající VAE a ControlNet se automaticky použijí. Neomezená generace, pevná cena.

Otázky

Co by měl začátečník stáhnout jako první?

Jeden checkpoint rodiny, kterou chceš používat. LoRA až potom, až budeš vědět, který základ se ti líbí. Embeddingy a ControlNety až když je konkrétní problém vyžaduje.

Můžu sloučit LoRU do checkpointu?

Jo, každé UI má nástroj na merge a výsledek je nový checkpoint. Ušetří to uzel, ale váha se zamrzne; většina lidí si LoRA nechává zvlášť.

Je fine-tune to samé co LoRA?

Ne. Fine-tune přetrénuje celý checkpoint (gigabajty); LoRA je malý doplněk (megabajty). Hodně fine-tunů začalo jako LoRA, která se sloučila.

Používají Flux a Qwen embeddingy?

Prakticky nikdy. Jejich LLM textové enkodéry nejsou tak trénované; styl a koncepty řeší LoRA.

Co je workflow soubor?

ComfyUI JSON, který tyto komponenty propojuje. Katalog je označuje jako „jiné“; neobsahují váhy, jen recept.

Odkazy a zdroje

Modely v tomto návodu

Napsal
Quartermaster

Související návody

Modely
Co je to LoRA a jak ji používat v ComfyUI, Forge, Automatic1111 a v cloudu
LoRA vysvětlená pro ty, kdo chtějí výsledky, ne matematiku: co soubor LoRA mění, proč musí odpovídat rodině základního modelu, spouštěcí slova, váhy, skládání více LoR, složka a syntaxe pro každé UI a jak si LoRU vyzkoušet v cloudu před stažením.
Autor: Captain
2026-05-20
Aplikace
Jak nainstalovat LoRA: složky, kontrola souborů a první použití v ComfyUI, Forge, Automatic1111 a Draw Things
Praktický návod na instalaci: odkud stáhnout LoRA, jak zkontrolovat hash souboru podle stránky modelu, do které složky ji dát pro každé oblíbené UI, jak obnovit seznam, jak ji poprvé načíst a tři způsoby, jak ji používat v cloudu bez instalace.
Autor: Lookout
2025-09-24
Modely
Jak fungují generativní AI modely pro obrázky: jednoduše o difuzi, latentních prostorech a textových enkodérech
Jak fungují Stable Diffusion, SDXL, Flux a video modely bez matematiky: co má šum společného s tím, proč modely pracují v komprimovaném latentním prostoru, co dělá textový enkodér a VAE, co opravdu mění kroky a vedení a proč tréninková data určují, co model dokáže nakreslit.
Autor: Quartermaster
2025-08-28
Promptování
ControlNet vysvětleno: póza, hloubka, hrany a referenční obrázky pro SD 1.5, SDXL a Flux
Jak ControlNet donutí model sledovat pózu, hloubkovou mapu, kresbu hran nebo náčrt místo hádání kompozice z promptu: běžné typy ovládání a kdy který použít, krok předzpracování, nastavení síly a koncového procenta, soubory pro jednotlivé rodiny a alternativy z éry Flux (Flux Depth, Canny, Kontext).
Autor: Captain
2026-02-18
Modely
Zvětšování AI obrázků: modely ESRGAN, hires-fix, tiled diffusion a kdy který použít
Tři typy zvětšování a k čemu jsou: rychlé pixelové zvětšovače (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) pro čisté zvětšení, hires-fix pro přidání detailů při generování a tiled diffusion (Ultimate SD Upscale, SUPIR, Flux-based) pro přeměnu 1024 renderu na detailní 4K tisk; s hodnotami denoise, velikostmi dlaždic a modely, které stojí za stažení.
Autor: Quartermaster
2026-03-04

Další návody

Modely
FLUX.1 Dev: jak ho promptovat, nejlepší nastavení a kreativní nápady
Praktický průvodce FLUX.1 Dev od Black Forest Labs: promptování v přirozeném jazyce, nastavení guidance a kroků, vrstvení LoRA, vykreslování textu a nápady na prompty, které využívají jeho silné stránky.
Autor: Captain
2026-09-30
Modely
Stable Diffusion XL 1.0: promptování, nastavení a co stále umí nejlíp
Jak vytěžit maximum z oficiálního základního modelu SDXL 1.0: nativní rozlišení, nastavení CFG a sampleru, refiner, negativní prompt a nápady na styly, kde SDXL stále vyniká.
Autor: Captain
2026-10-01
Modely
Stable Diffusion 1.5: klasický model, správně promptovaný
Stable Diffusion 1.5 stojí za to znát: správné rozlišení, CFG a sampler, jak používat jeho obrovskou knihovnu LoRAs a embeddingů a kreativní nápady na prompt vhodné pro model s rozlišením 512 pixelů.
Autor: Captain
2026-10-02
Modely
FLUX.2 Dev: zadávání příkazů pro nejnovější model Black Forest Labs
FLUX.2 Dev přináší delší příkazy, lepší text, silnější realismus a úpravy s více odkazy. Tento průvodce pokrývá turbo workflow, nastavení vedení a rozlišení, strukturu příkazů a nápady, které využívají jeho nové možnosti.
Autor: Captain
2026-10-03
Modely
Qwen-Image: dlouhé prompti, perfektní text a dvoujazyčné plakáty
Qwen-Image je model, ke kterému sáhneš, když na slovech na obrázku záleží. Nauč se psát jeho dlouhé popisné prompti, přesně vykreslovat anglický a čínský text, nastavovat CFG a kroky a objevovat nápady s hodně rozvržením.
Autor: Captain
2026-09-29
Modely
SDXL-Lightning: generování ve čtyřech krocích na jakémkoli SDXL checkpointu
LoRA SDXL-Lightning od ByteDance promění 30-krokový render SDXL na 4-krokový. Nauč se, kolik kroků použít, jaké CFG nastavit, jaký sampler zvolit a jak to zkombinovat s tvými oblíbenými checkpointy a stylovými LoRA.
Autor: Captain
2026-09-30