Model
Trends
.ai
Model
Trends
.ai
model AI sumber terbuka terbaik

Checkpoint vs LoRA vs embedding vs ControlNet: fail mana buat apa

Topik: Model
Oleh Quartermaster
Diterbitkan 2025-10-08
Share

Gambaran keseluruhan

Pengguna baru muat turun "model" dan dapati ia salah satu dari enam benda berbeza yang masuk dalam enam folder berbeza dan buat enam kerja berbeza. Katalog di laman ini label setiap entri dengan jenisnya (base model,
LoRA
, embedding, lain-lain) dan keluarganya sebab itu. Panduan ini terangkan jenis-jenis sekali supaya label itu masuk akal.
Peraturan mudah: checkpoint adalah pelukis penuh; LoRA ajar pelukis subjek atau gaya baru; embedding ajar pelukis perkataan baru;
ControlNet
atau IP-Adapter beritahu pelukis di mana letak benda atau apa nak salin dari rujukan; VAE adalah mata pelukis yang tukar antara kanvas dan ruang kerja mampat;
upscaler
adalah tukang lain yang besarkan gambar siap. Hanya checkpoint boleh kerja sendiri. Semua lain perlukan checkpoint dari keluarga yang sama.
Saiz bagi banyak info. 2 hingga 7 GB untuk checkpoint
SDXL
dan 12 hingga 24 GB untuk
Flux
; 10 hingga 700 MB untuk LoRA; bawah 1 MB untuk embedding; 1 hingga 2.5 GB untuk ControlNet; 300 MB untuk VAE; 60 MB untuk ESRGAN upscaler. Kalau fail yang dipanggil LoRA 6 GB, itu checkpoint. Halaman model di sini tunjuk saiz dan hash supaya kamu boleh tahu sebelum muat turun.

Rujukan

Nama
Jenis
Apakah ia
Checkpoint (base model)
2-24 GB
Denoiser penuh, biasanya dengan text encoder dan VAE sekali. Fine-tunes (DreamShaper, Juggernaut,
Illustrious
, Pony) adalah checkpoints yang dilatih semula dengan data baru. Folder: models/checkpoints (
ComfyUI
), models/Stable-diffusion (A1111,
Forge
). Flux,
Qwen
dan
Wan
dihantar sebagai fail diffusion_models + text_encoders + vae berasingan.
10-700 MB
Perbezaan berat kecil yang dipakai atas checkpoint. Watak, gaya, konsep, slider, gerakan. Perlukan trigger word dan berat. Folder: models/loras atau models/Lora.
LyCORIS / LoCon / LoHa / DoRA
10-700 MB
Varian LoRA yang sentuh lebih banyak lapisan atau guna faktorasi berbeza. Dimuat seperti LoRA dalam semua UI sekarang.
Embedding (textual inversion)
10-200 KB
Token yang dipelajari untuk text encoder. Dipanggil dengan nama fail dalam prompt. Biasa sebagai negative embeddings (bad-hands, easynegative) pada
SD 1.5
dan SDXL; jarang pada Flux. Folder: models/embeddings.
ControlNet
/ T2I-Adapter
0.3-2.5 GB
Rangkaian sampingan yang kondisikan denoiser pada pose, peta kedalaman, peta tepi atau coretan. Keluarga spesifik. Folder: models/controlnet.
IP-Adapter / reference
50 MB-1 GB
Kondisikan pada imej bukan teks: pemindahan gaya, rujukan muka. Perlukan model visi CLIP yang sepadan.
VAE
160-330 MB
Encoder/decoder antara piksel dan latents. Biasanya sekali dalam checkpoint; fail berasingan betulkan warna pudar (SDXL fp16-fix) atau datang dengan keluarga baru (Flux ae.safetensors, Wan VAE).
2-70 MB
ESRGAN, Real-ESRGAN, SwinIR, DAT: rangkaian berasingan yang besarkan piksel selepas penjanaan. Folder: models/upscale_models.
AD
Tiada folder, tiada jenis fail, tiada cari VAE
BitVector Prism pra-muat checkpoint, LoRA, VAE dan ControlNets yang sepadan. Pilih model dari laman ini, pilih add-on dan jana dalam pelayar.

Langkah demi langkah

  1. Kenal pasti jenis fail dari label katalog dan saiz sebelum muat turun. Base model, LoRA, embedding atau lain-lain pada kad; saiz tepat pada halaman model.
  2. Padankan keluarga. Setiap fail bukan checkpoint namakan keluarga yang dibina untuknya (SDXL, Flux,
    Wan 2.2
    14B); ia hanya berfungsi dengan checkpoint keluarga itu.
  3. Letak fail dalam folder jenisnya (jadual atas) dan segar semula UI.
  4. Checkpoint: pilih sebagai model. Untuk keluarga pecah (Flux, Qwen, Wan,
    Z-Image
    ) muat model diffusion, text encoders dan VAE secara berasingan dalam ComfyUI.
  5. LoRA: Muat node LoRA selepas checkpoint, atau <lora:name:0.8> dalam prompt, plus trigger word.
  6. Embedding: taip nama fail dalam prompt (atau prompt negatif untuk embedding negatif); ComfyUI guna embedding:name.
  7. ControlNet: Guna node ControlNet dengan imej yang diproses (pose, depth); mula dengan kekuatan 0.8 dan peratus akhir 0.8.
  8. VAE dan upscaler: pilih VAE dalam loader atau tetapan bila warna salah; jalankan upscaler sebagai langkah akhir melalui Upscale Image (guna Model).

Contoh

Set lengkap SDXL dalam prompt Forge

Checkpoint: juggernautXL_v9.safetensors | VAE: sdxl_vae_fp16fix.safetensors
Prompt: zavy cinematic, <lora:zavy-cinematic-xl:0.7> a knight resting by a campfire, night, embers, 35mm
Negative: easynegative, bad-hands-5, blurry | ControlNet: openpose, weight 0.8 | Upscaler: 4x-UltraSharp 2x

Set sama sebagai node ComfyUI

Load Checkpoint -> Load LoRA -> Apply ControlNet (OpenPose image) -> KSampler -> VAE Decode (fp16-fix VAE) -> Upscale Image (using Model: 4x-UltraSharp)

Petua

  • Jenis katalog "lain" meliputi ControlNets, VAEs,
    upscalers
    dan workflow; halaman model beritahu yang mana.
  • Merges adalah checkpoints yang dibuat dengan purata checkpoint lain; mereka warisi keluarga ibu bapa dan kekal serasi dengan LoRA.
  • Checkpoint
    inpainting
    adalah checkpoint dengan saluran input tambahan; perlukan workflow inpainting dan bukan ganti terus untuk text-to-image.
  • Embedding negatif adalah cara SD 1.5 betulkan tangan; pada SDXL kurang membantu dan pada Flux tak berkesan sebab model tiada
    CFG
    negatif.
  • Flux Fill, Flux Redux, Flux Depth dan Canny adalah checkpoints atau adapter, bukan LoRA, walaupun mereka dihantar bersama LoRA di hub.
  • Kalau ragu, rakan awan ada gabungan betul siap dimuat: pilih model dan LoRA, VAE dan ControlNet sepadan diuruskan untuk kamu.

Penyelesaian masalah

Muat turun "LoRA" tapi saiz 6 GB

Mengapa ia berlaku
Ia checkpoint; pemuat naik label longgar.

Cara membaikinya
Letak dalam folder checkpoints dan pilih sebagai model. Label katalog di sini boleh dipercayai.

Embedding tak buat apa-apa

Mengapa ia berlaku
Keluarga salah (embedding SD 1.5 pada SDXL), atau nama yang ditaip tak sama dengan nama fail.

Cara membaikinya
Padankan keluarga; taip nama fail tepat tanpa sambungan; dalam ComfyUI guna embedding:name.

ControlNet bagi bunyi atau abaikan pose

Mengapa ia berlaku
ControlNet untuk keluarga lain, atau gambar mentah diberi bukan peta yang diproses.

Cara membaikinya
Guna ControlNet yang dibina untuk keluarga checkpoint dan jalankan node preprocessor dulu.

Warna nampak pudar

Mengapa ia berlaku
VAE hilang atau salah.

Cara membaikinya
Muat VAE keluarga; pada SDXL guna fp16-fix VAE.

Model muat tapi hasil gambar hitam

Mengapa ia berlaku
fp16 overflow dalam VAE atau checkpoint perlukan --no-half-vae.

Cara membaikinya
Guna fp16-fix VAE atau flag no-half-vae; pada Flux pastikan ketepatan text encoder sama dengan binaan.

AD
PirateDiffusion
Checkpoint, LoRA, embedding dan ControlNet, dah siap sambung
PirateDiffusion susun ribuan fail model untuk kamu di GPU sendiri; kamu sebut checkpoint dan tag LoRA dalam arahan Telegram dan VAE serta ControlNet sepadan dipakai. Jana tanpa had, harga tetap.

Soalan

Mana satu patut pemula muat turun dulu?

Satu checkpoint dari keluarga yang kamu nak guna. LoRA datang kedua, bila dah tahu base mana kamu suka. Embedding dan ControlNet bila ada masalah khusus perlukan mereka.

Boleh tak gabungkan LoRA ke checkpoint?

Boleh, setiap UI ada alat merge, hasilnya checkpoint baru. Jimat node tapi berat beku; ramai simpan LoRA berasingan.

Fine-tune sama dengan LoRA?

Tidak. Fine-tune latih semula checkpoint penuh (gigabyte); LoRA tambah kecil (megabyte). Ramai fine-tune mula sebagai LoRA yang digabung.

Flux dan Qwen guna embedding?

Hampir tak pernah. Text encoder LLM mereka tak dilatih macam itu; kerja gaya dan konsep guna LoRA.

Apa itu fail workflow?

JSON ComfyUI yang sambungkan komponen ini. Katalog senaraikan sesetengah sebagai "lain"; ia tiada berat, cuma resipi.

Pautan dan sumber

Model dalam panduan ini

Ditulis oleh
Quartermaster

Panduan berkaitan

Model
Apa itu LoRA dan cara menggunakannya di ComfyUI, Forge, Automatic1111 dan di awan
Penjelasan LoRA untuk orang yang mahu hasil, bukan matematik: apa yang diubah oleh fail LoRA, kenapa ia mesti sepadan dengan keluarga model asas, kata pencetus, berat, menumpuk beberapa LoRA, folder dan sintaks untuk setiap UI, dan cara cuba LoRA di awan sebelum memuat turun apa-apa.
Oleh Captain
2026-05-20
Aplikasi
Cara memasang LoRA: folder, pemeriksaan fail dan penggunaan pertama dalam ComfyUI, Forge, Automatic1111 dan Draw Things
Panduan pemasangan praktikal: dari mana nak muat turun LoRA, cara periksa hash fail dengan halaman model, folder mana yang kena untuk setiap UI popular, cara segar semula senarai, cara muatkan kali pertama, dan tiga cara guna LoRA di awan tanpa pasang apa-apa.
Oleh Lookout
2025-09-24
Model
Bagaimana model imej AI generatif berfungsi: penjelasan mudah tentang difusi, latens dan pengekod teks
Mekanisme di sebalik Stable Diffusion, SDXL, Flux dan model video tanpa matematik: apa kaitan bunyi dengan proses ini, kenapa model berfungsi dalam ruang latens yang dimampatkan, apa fungsi pengekod teks dan VAE, apa yang benar-benar berubah dengan langkah dan panduan, dan kenapa data latihan menentukan apa yang model boleh lukis.
Oleh Quartermaster
2025-08-28
Prompting
ControlNet diterangkan: pose, kedalaman, tepi dan imej rujukan untuk SD 1.5, SDXL dan Flux
Bagaimana ControlNet membuat model mengikuti pose, peta kedalaman, lukisan tepi atau coretan dan bukannya meneka komposisi dari prompt: jenis kawalan biasa dan bila nak guna setiap satu, langkah prapemproses, tetapan kekuatan dan peratus tamat, fail khusus keluarga, dan alternatif era Flux (Flux Depth, Canny, Kontext).
Oleh Captain
2026-02-18
Model
Meningkatkan imej AI: model ESRGAN, hires-fix, penyebaran bertiles dan bila setiap satu sesuai
Tiga keluarga peningkatan dan kegunaannya: penambah piksel pantas (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) untuk pembesaran bersih, hires-fix untuk menambah butiran semasa penjanaan, dan penyebaran bertiles (Ultimate SD Upscale, SUPIR, berasaskan Flux) untuk menukar render 1024 menjadi cetakan 4K yang terperinci; dengan nilai denoise, saiz tile dan model yang patut dimuat turun.
Oleh Quartermaster
2026-03-04

Lagi panduan

Perkhidmatan awan
Bayaran tetap vs token: kenapa pelan tanpa had seperti Graydient.ai adalah nilai terbaik untuk pencipta AI pada 2026
Perbandingan kos berperingkat, dengan harga diperiksa pada 8 Oktober 2026, pelan tanpa had bayaran tetap seperti Graydient.ai berbanding harga token dan kredit dari Midjourney, Leonardo, fal.ai, Replicate, Runway dan Kling: berapa kos sebenar 1,000 imej dan 1,000 video sebulan pada setiap satu, dan kenapa satu bayaran tetap untuk imej, video, audio, sembang Grok LLM dan aplikasi web tanpa had adalah nilai terbaik untuk pencipta yang membuat iterasi.
Oleh Captain
2026-10-08
Model
FLUX.1 Dev: cara memberi arahan, tetapan terbaik dan idea kreatif
Panduan praktikal untuk FLUX.1 Dev oleh Black Forest Labs: cara memberi arahan dalam bahasa biasa, tetapan panduan dan langkah, penumpukan LoRA, rendering teks dan idea arahan yang memanfaatkan kekuatannya.
Oleh Captain
2026-09-30
Model
Stable Diffusion XL 1.0: prompt, tetapan dan apa yang masih terbaik
Cara untuk dapatkan hasil terbaik dari model asas rasmi SDXL 1.0: resolusi asli, tetapan CFG dan sampler, refiner, prompt negatif dan idea gaya di mana SDXL masih menonjol.
Oleh Captain
2026-10-01
Model
Stable Diffusion 1.5: model klasik, dipandu dengan betul
Stable Diffusion 1.5 masih patut diketahui: resolusi yang betul, CFG dan sampler, cara guna perpustakaan besar LoRA dan embeddingnya, serta idea prompt kreatif yang sesuai untuk model 512-piksel.
Oleh Captain
2026-10-02
Model
FLUX.2 Dev: memicu model terbaru Black Forest Labs
FLUX.2 Dev membawa prompt yang lebih panjang, teks yang lebih baik, realisme yang lebih kuat dan penyuntingan multi-rujukan. Panduan ini merangkumi aliran kerja turbo, tetapan panduan dan resolusi, struktur prompt dan idea yang menggunakan kekuatan barunya.
Oleh Captain
2026-10-03
Model
Qwen-Image: arahan panjang, teks sempurna dan poster dwibahasa
Qwen-Image adalah model yang sesuai bila perkataan dalam gambar penting. Pelajari cara menulis arahan panjang yang terperinci, hasilkan teks Inggeris dan Cina dengan tepat, tetapkan CFG dan langkah, serta terokai idea kreatif yang berat pada susun atur.
Oleh Captain
2026-09-29