Checkpoint vs LoRA vs embedding vs ControlNet: ce face fiecare fișier
Subiect: Modele
De Quartermaster
Publicat 2025-10-08
Cele șase tipuri de fișiere de model pe care le vei întâlni, ce schimbă fiecare, cât de mare este, unde se pune și când să le folosești: checkpoint-uri și fine-tune-uri, LoRA-uri și rudele lor LyCORIS, embedding-uri de inversare textuală, ControlNet-uri și IP-Adaptere, VAE-uri și upscalere.
Prezentare generală
Un utilizator nou descarcă un „model” și descoperă că este unul dintre șase lucruri diferite care se pun în șase foldere diferite și fac șase trebi diferite. Catalogul de pe acest site etichetează fiecare intrare cu tipul său (model de bază,
LoRA
, embedding, altceva) și familia sa din acest motiv. Acest ghid explică tipurile o dată, ca să înțelegi etichetele.
Regula de bază: un checkpoint este pictorul complet; un LoRA îl învață pe pictor un subiect sau stil nou; un embedding îl învață pe pictor un cuvânt nou; un
ControlNet
sau IP-Adapter îi spune pictorului unde să pună lucrurile sau ce să copieze dintr-o referință; VAE-ul sunt ochii pictorului care transformă între pânză și spațiul de lucru comprimat; un
upscaler
este un alt meșter care mărește poza finală. Doar checkpoint-ul poate funcționa singur. Restul au nevoie de un checkpoint din aceeași familie.
Mărimile spun multe. 2 până la 7 GB pentru un checkpoint
SDXL
și 12 până la 24 GB pentru
Flux
; 10 până la 700 MB pentru un LoRA; sub 1 MB pentru un embedding; 1 până la 2,5 GB pentru un ControlNet; 300 MB pentru un VAE; 60 MB pentru un upscaler ESRGAN. Dacă un fișier numit LoRA are 6 GB, este un checkpoint. Pagina modelului aici arată mărimea și hash-ul ca să știi înainte să descarci.
Referință
Nume | Tip | Ce este |
|---|---|---|
Checkpoint (base model) | 2-24 GB | Denoiserul complet, de obicei cu text encoder și VAE incluse. Fine-tune-urile (DreamShaper, Juggernaut, Illustrious , Pony) sunt checkpoint-uri retrainate pe date noi. Folder: models/checkpoints ( ComfyUI ), models/Stable-diffusion (A1111, Forge ). Flux, Qwen și Wan vin ca fișiere separate diffusion_models + text_encoders + vae. |
LoRA | 10-700 MB | O diferență mică de greutate aplicată peste un checkpoint. Personaje, stiluri, concepte, slider-e, mișcare. Are nevoie de un cuvânt declanșator și o greutate. Folder: models/loras sau models/Lora. |
LyCORIS / LoCon / LoHa / DoRA | 10-700 MB | Variante de LoRA care ating mai multe straturi sau folosesc o factorizare diferită. Se încarcă ca LoRA-urile în orice UI actual. |
Embedding (textual inversion) | 10-200 KB | Un token învățat pentru text encoder. Apelat după numele fișierului în prompt. Comun ca embedding-uri negative (bad-hands, easynegative) pe SD 1.5 și SDXL; rar pe Flux. Folder: models/embeddings. |
ControlNet / T2I-Adapter | 0.3-2.5 GB | O rețea laterală care condiționează denoiserul pe o poziție, hartă de adâncime, margine sau schiță. Specifică familiei. Folder: models/controlnet. |
IP-Adapter / reference | 50 MB-1 GB | Condiționează pe o imagine în loc de text: transfer de stil, referință față. Are nevoie de un model CLIP vision potrivit. |
VAE | 160-330 MB | Encoder/decoder între pixeli și latents. De obicei vine inclus în checkpoint-uri; fișiere separate repară culorile spălăcite (SDXL fp16-fix) sau vin cu familii noi (Flux ae.safetensors, Wan VAE). |
Upscaler | 2-70 MB | ESRGAN, Real-ESRGAN, SwinIR, DAT: rețele separate care măresc pixelii după generare. Folder: models/upscale_models. |
AD

Fără foldere, fără tipuri de fișiere, fără să cauți VAE
BitVector Prism preîncarcă checkpoint-ul, LoRA-urile, VAE-ul și ControlNet-urile care merg împreună. Alege un model de pe site, alege un add-on și generează în browser.
Pas cu pas
- Identifică tipul fișierului din eticheta catalogului și mărimea înainte să descarci. Model de bază, LoRA, embedding sau altceva pe card; exact bytes pe pagina modelului.
- Potrivește familia. Fiecare fișier non-checkpoint numește familia pentru care a fost făcut (SDXL, Flux,Wan 2.214B); funcționează doar cu checkpoint-uri din familia respectivă.
- Pune fișierul în folderul pentru tipul lui (tabelul de mai sus) și reîncarcă UI-ul.
- Checkpoint: selectează-l ca model. Pentru familii împărțite (Flux, Qwen, Wan,Z-Image) încarcă separat diffusion model, text encoders și VAE în ComfyUI.
- LoRA: încarcă nodul LoRA după checkpoint, sau <lora:name:0.8> în prompt, plus cuvântul declanșator.
- Embedding: scrie numele fișierului în prompt (sau în promptul negativ pentru embedding-uri negative); ComfyUI folosește embedding:name.
- ControlNet: aplică nodul ControlNet cu imaginea preprocesată (poziție, adâncime); începe cu putere 0.8 și procent final 0.8.
- VAE și upscaler: selectează VAE-ul în loader sau setări când culorile sunt greșite; rulează upscaler-ul ca ultim pas prin Upscale Image (folosind Model).
Exemple
Un pachet complet SDXL într-un prompt Forge
Checkpoint: juggernautXL_v9.safetensors | VAE: sdxl_vae_fp16fix.safetensors
Prompt: zavy cinematic, <lora:zavy-cinematic-xl:0.7> a knight resting by a campfire, night, embers, 35mm
Negative: easynegative, bad-hands-5, blurry | ControlNet: openpose, weight 0.8 | Upscaler: 4x-UltraSharp 2x
Același pachet ca noduri ComfyUI
Load Checkpoint -> Load LoRA -> Apply ControlNet (OpenPose image) -> KSampler -> VAE Decode (fp16-fix VAE) -> Upscale Image (using Model: 4x-UltraSharp)
Sfaturi
- Tipul catalogului „altceva” acoperă ControlNet-uri, VAE-uri, upscalere și workflow-uri; pagina modelului spune care.
- Merge-urile sunt checkpoint-uri făcute prin media altor checkpoint-uri; moștenesc familia părinților și păstrează compatibilitatea cu LoRA.
- Un checkpoint deinpaintingare canale de intrare suplimentare; are nevoie de workflow-ul de inpainting și nu poate înlocui direct text-to-image.
- Embedding-urile negative erau metoda SD 1.5 de a repara mâinile; pe SDXL ajută mai puțin, iar pe Flux nu fac nimic pentru că modelul nu areCFGnegativ.
- Flux Fill, Flux Redux, Flux Depth și Canny sunt checkpoint-uri sau adaptoare, nu LoRA-uri, chiar dacă vin lângă LoRA-uri pe hub.
- Când ai dubii, partenerii cloud au combinația corectă preîncărcată: alegi modelul și LoRA-ul, iar VAE-ul și ControlNet-ul potrivite sunt gestionate pentru tine.
Depanare
Am descărcat un „LoRA” și are 6 GB
De ce se întâmplă
Este un checkpoint; uploader-ul l-a etichetat greșit.
Cum se repară
Pune-l în folderul checkpoints și selectează-l ca model. Eticheta din catalog de aici e de încredere.
Embedding-ul nu face nimic
De ce se întâmplă
Familie greșită (embedding SD 1.5 pe SDXL), sau numele tastat nu corespunde cu numele fișierului.
Cum se repară
Potrivește familia; scrie numele exact al fișierului fără extensie; în ComfyUI folosește embedding:name.
ControlNet dă zgomot sau ignoră poziția
De ce se întâmplă
ControlNet pentru altă familie, sau s-a folosit poza brută în loc de harta preprocesată.
Cum se repară
Folosește ControlNet-ul făcut pentru familia checkpoint-ului și rulează mai întâi nodul preprocesor.
Culorile par spălăcite
De ce se întâmplă
VAE lipsă sau greșit.
Cum se repară
Încarcă VAE-ul familiei; pe SDXL VAE-ul fp16-fix.
Modelul se încarcă dar generează imagini negre
De ce se întâmplă
Overflow fp16 în VAE sau checkpoint care are nevoie de --no-half-vae.
Cum se repară
Folosește VAE-ul fp16-fix sau flag-ul no-half-vae; pe Flux verifică dacă precizia text encoder-ului corespunde build-ului.
AD

Checkpoint-uri, LoRA-uri, embedding-uri și ControlNet-uri, deja legate
PirateDiffusion ține mii de fișiere de model organizate pe propriile GPU-uri; spui checkpoint-ul și tag-urile LoRA într-o comandă Telegram și VAE-ul și ControlNet-urile potrivite se aplică. Generare nelimitată, preț fix.
Întrebări
Ce ar trebui să descarce un începător prima dată?
Un checkpoint din familia pe care vrei să o folosești. LoRA-urile vin după, când știi ce bază îți place. Embedding-urile și ControlNet-urile vin când ai o problemă specifică.
Pot să integrez un LoRA într-un checkpoint?
Da, orice UI are un instrument de merge, iar rezultatul e un checkpoint nou. Economisește un nod, dar fixează greutatea; majoritatea păstrează LoRA-urile separate.
Un fine-tune e la fel cu un LoRA?
Nu. Fine-tune-ul retrain-ează tot checkpoint-ul (gigabytes); LoRA e un adaos mic (megabytes). Multe fine-tune-uri au început ca LoRA-uri integrate.
Flux și Qwen folosesc embedding-uri?
Practic niciodată. Text encoder-ele lor LLM nu sunt antrenate așa; stilul și conceptele se fac cu LoRA-uri.
Ce e un fișier workflow?
Un JSON ComfyUI care le leagă pe toate astea. Catalogul listează unele ca „altceva”; nu conțin greutăți, doar rețeta.
Linkuri și surse
- LoRA paper (Hu et al., 2021)
- Textual inversion paper (Gal et al., 2022)
- ControlNet paper (Zhang et al., 2023)
- SDXL family page
- Upscalers family page
- PirateDiffusion
Modele din acest ghid
Scris de
Quartermaster
Ghiduri conexe
Modele
Ce este un LoRA și cum să folosești unul în ComfyUI, Forge, Automatic1111 și în cloud
LoRA explicat pentru cei care vor rezultate, nu matematică: ce schimbă un fișier LoRA, de ce trebuie să se potrivească cu familia modelului de bază, cuvinte trigger, greutăți, cum să combini mai multe LoRA, folderul și sintaxa pentru fiecare UI și cum să încerci un LoRA în cloud înainte să descarci ceva.
De Captain
2026-05-20
Aplicații
Cum să instalezi un LoRA: foldere, verificări de fișiere și prima utilizare în ComfyUI, Forge, Automatic1111 și Draw Things
Ghid practic de instalare: de unde descarci un LoRA, cum verifici hash-ul fișierului față de pagina modelului, în ce folder îl pui pentru fiecare UI popular, cum reîmprospătezi lista, cum îl încarci prima dată și cele trei moduri de a folosi unul în cloud fără să instalezi nimic.
De Lookout
2025-09-24
Modele
Cum funcționează modelele generative AI pentru imagini: difuzie, latente și encodere de text explicate simplu
Mecanismele din spatele Stable Diffusion, SDXL, Flux și modelelor video fără matematică: ce legătură are zgomotul, de ce modelele lucrează într-un spațiu latent comprimat, ce fac encoderul de text și VAE, ce schimbă cu adevărat pașii și ghidarea, și de ce datele de antrenament decid ce poate desena un model.
De Quartermaster
2025-08-28
Prompting
ControlNet explicat: poziție, adâncime, margini și imagini de referință pentru SD 1.5, SDXL și Flux
Cum face ControlNet ca un model să urmeze o poziție, o hartă de adâncime, un desen de margini sau un schițaj în loc să ghicească compoziția din prompt: tipurile comune de control și când să folosești fiecare, pasul de preprocesare, setările de intensitate și procentul de final, fișierele specifice familiei și alternativele din era Flux (Flux Depth, Canny, Kontext).
De Captain
2026-02-18
Modele
Mărirea imaginilor AI: modele ESRGAN, hires-fix, difuzie pe plăci și când să folosești fiecare
Cele trei familii de mărire și la ce folosesc: măriri rapide pe pixeli (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) pentru mărire curată, hires-fix pentru adăugarea de detalii în timpul generării și difuzia pe plăci (Ultimate SD Upscale, SUPIR, bazat pe Flux) pentru transformarea unui render 1024 într-un print 4K detaliat; cu valori de denoise, dimensiuni de plăci și modelele care merită descărcate.
De Quartermaster
2026-03-04
Mai multe ghiduri
Modele
FLUX.1 Dev: cum să-l folosești, cele mai bune setări și idei creative
Un ghid practic pentru FLUX.1 Dev de la Black Forest Labs: cum să dai comenzi în limbaj natural, setările pentru ghidare și pași, cum să combini LoRA-uri, redarea textului și idei de prompturi care îi pun în valoare punctele forte.
De Captain
2026-09-30
Modele
Stable Diffusion XL 1.0: prompturi, setări și ce face încă cel mai bine
Cum să profiți la maximum de modelul oficial SDXL 1.0 de bază: rezoluții native, setări CFG și sampler, refinerul, prompturi negative și idei pentru stiluri unde SDXL încă strălucește.
De Captain
2026-10-01
Modele
Stable Diffusion 1.5: modelul clasic, folosit corect
Stable Diffusion 1.5 merită să fie cunoscut în continuare: rezoluția potrivită, CFG și sampler-ul, cum să folosești biblioteca uriașă de LoRA și embeddings, plus idei creative de prompturi potrivite pentru un model de 512 pixeli.
De Captain
2026-10-02
Modele
FLUX.2 Dev: cum să folosești cel mai nou model Black Forest Labs
FLUX.2 Dev aduce prompturi mai lungi, text mai bun, realism mai puternic și editare cu referințe multiple. Acest ghid acoperă fluxul turbo, setările de ghidare și rezoluție, structura promptului și idei care folosesc noile sale puncte forte.
De Captain
2026-10-03
Modele
Qwen-Image: prompturi lungi, text perfect și postere bilingve
Qwen-Image e modelul la care apelezi când contează cuvintele din imagine. Învață cum să scrii prompturi lungi și descriptive, să redai text în engleză și chineză corect, să setezi CFG și pașii, și să explorezi idei creative cu layout complex.
De Captain
2026-09-29
Modele
SDXL-Lightning: generare în patru pași pe orice checkpoint SDXL
LoRA SDXL-Lightning de la ByteDance transformă o randare SDXL de 30 de pași într-una de 4 pași. Află câți pași trebuie să folosești, ce CFG să setezi, ce sampler să alegi și cum să îl combini cu checkpoint-urile și LoRA-urile tale preferate de stil.
De Captain
2026-09-30

Model
Trends
.ai
© ModelTrends.ai
|
Realizat în Japonia
|
© 2026