Checkpoint vs LoRA vs embedding vs ControlNet: file mana yang buat apa
Topik: Model
Oleh Quartermaster
Diterbitkan 2025-10-08
Ikhtisar
Pengguna baru mengunduh "model" dan menemukan itu adalah salah satu dari enam hal berbeda yang masuk ke enam folder berbeda dan punya enam fungsi berbeda. Katalog di situs ini memberi label setiap entri dengan jenisnya (base model,
LoRA
, embedding, lain-lain) dan keluarganya untuk alasan itu. Panduan ini menjelaskan jenis-jenisnya sekali supaya labelnya masuk akal.
Aturan dasarnya: checkpoint adalah pelukis utuh; LoRA mengajarkan pelukis subjek atau gaya baru; embedding mengajarkan pelukis kata baru;
ControlNet
atau IP-Adapter memberi tahu pelukis di mana letak sesuatu atau apa yang harus disalin dari referensi; VAE adalah mata pelukis yang mengubah antara kanvas dan ruang kerja terkompresi;
upscaler
adalah pengrajin terpisah yang memperbesar gambar jadi. Hanya checkpoint yang bisa bekerja sendiri. Semua yang lain butuh checkpoint dari keluarga yang cocok.
Ukuran file banyak memberi tahu. 2 sampai 7 GB untuk checkpoint
SDXL
dan 12 sampai 24 GB untuk
Flux
; 10 sampai 700 MB untuk LoRA; kurang dari 1 MB untuk embedding; 1 sampai 2,5 GB untuk ControlNet; 300 MB untuk VAE; 60 MB untuk upscaler ESRGAN. Kalau file yang disebut LoRA ukurannya 6 GB, itu sebenarnya checkpoint. Halaman model di sini menunjukkan ukuran dan hash supaya kamu bisa tahu sebelum mengunduh.
Referensi
Nama | Tipe | Artinya |
|---|---|---|
Checkpoint (base model) | 2-24 GB | Denoiser lengkap, biasanya sudah termasuk text encoder dan VAE. Fine-tunes (DreamShaper, Juggernaut, Illustrious , Pony) adalah checkpoint yang dilatih ulang dengan data baru. Folder: models/checkpoints ( ComfyUI ), models/Stable-diffusion (A1111, Forge ). Flux, Qwen dan Wan dikirim sebagai file diffusion_models + text_encoders + vae terpisah. |
10-700 MB | Perbedaan bobot kecil yang diterapkan di atas checkpoint. Karakter, gaya, konsep, slider, gerakan. Butuh trigger word dan bobot. Folder: models/loras atau models/Lora. | |
LyCORIS / LoCon / LoHa / DoRA | 10-700 MB | Varian LoRA yang menyentuh lebih banyak lapisan atau menggunakan faktorisasi berbeda. Dimuat seperti LoRA di semua UI saat ini. |
Embedding (textual inversion) | 10-200 KB | Token yang dipelajari untuk text encoder. Dipanggil dengan nama file di prompt. Umum sebagai negative embeddings (bad-hands, easynegative) di SD 1.5 dan SDXL; jarang di Flux. Folder: models/embeddings. |
ControlNet / T2I-Adapter | 0.3-2.5 GB | Jaringan samping yang mengkondisikan denoiser pada pose, peta kedalaman, peta tepi atau coretan. Spesifik keluarga. Folder: models/controlnet. |
IP-Adapter / reference | 50 MB-1 GB | Mengkondisikan pada gambar bukan teks: transfer gaya, referensi wajah. Butuh model visi CLIP yang cocok. |
VAE | 160-330 MB | Encoder/decoder antara piksel dan latent. Biasanya sudah termasuk di checkpoint; file terpisah memperbaiki warna yang pudar (SDXL fp16-fix) atau datang dengan keluarga baru (Flux ae.safetensors, Wan VAE). |
2-70 MB | ESRGAN, Real-ESRGAN, SwinIR, DAT: jaringan terpisah yang memperbesar piksel setelah pembuatan. Folder: models/upscale_models. |
AD

Tanpa folder, tanpa tipe file, tanpa cari VAE
BitVector Prism pra-muat checkpoint, LoRA, VAE dan ControlNet yang cocok. Pilih model dari situs ini, pilih add-on dan buat langsung di browser.
Langkah demi langkah
- Kenali jenis file dari label katalog dan ukuran sebelum mengunduh. Base model, LoRA, embedding atau lain-lain di kartu; byte tepat di halaman model.
- Cocokkan keluarga. Setiap file non-checkpoint menyebutkan keluarga yang dibuat untuknya (SDXL, Flux,Wan 2.214B); hanya bekerja dengan checkpoint dari keluarga itu.
- Masukkan file ke folder sesuai jenisnya (lihat tabel di atas) dan segarkan UI.
- Checkpoint: pilih sebagai model. Untuk keluarga terpisah (Flux, Qwen, Wan,Z-Image) muat diffusion model, text encoder dan VAE secara terpisah di ComfyUI.
- LoRA: muat node LoRA setelah checkpoint, atau <lora:name:0.8> di prompt, plus trigger word.
- Embedding: ketik nama file di prompt (atau prompt negatif untuk negative embeddings); ComfyUI pakai embedding:name.
- ControlNet: pakai node ControlNet dengan gambar yang sudah diproses (pose, depth); mulai dengan strength 0.8 dan end percent 0.8.
- VAE dan upscaler: pilih VAE di loader atau pengaturan saat warna salah; jalankan upscaler sebagai langkah akhir lewat Upscale Image (pakai Model).
Contoh
Tumpukan SDXL lengkap dalam prompt Forge
Checkpoint: juggernautXL_v9.safetensors | VAE: sdxl_vae_fp16fix.safetensors
Prompt: zavy cinematic, <lora:zavy-cinematic-xl:0.7> a knight resting by a campfire, night, embers, 35mm
Negative: easynegative, bad-hands-5, blurry | ControlNet: openpose, weight 0.8 | Upscaler: 4x-UltraSharp 2x
Tumpukan yang sama sebagai node ComfyUI
Load Checkpoint -> Load LoRA -> Apply ControlNet (OpenPose image) -> KSampler -> VAE Decode (fp16-fix VAE) -> Upscale Image (using Model: 4x-UltraSharp)
Tips
- Jenis katalog "lain-lain" mencakup ControlNets, VAEs,upscalersdan workflow; halaman model menyebutkan mana.
- Merge adalah checkpoint yang dibuat dengan merata-ratakan checkpoint lain; mewarisi keluarga induknya dan tetap kompatibel dengan LoRA.
- Checkpointinpaintingadalah checkpoint dengan saluran input ekstra; butuh workflow inpainting dan bukan pengganti langsung untuk text-to-image.
- Negative embeddings dulu cara SD 1.5 memperbaiki tangan; di SDXL kurang membantu dan di Flux tidak berpengaruh karena model tidak punyaCFGnegatif.
- Flux Fill, Flux Redux, Flux Depth dan Canny adalah checkpoint atau adapter, bukan LoRA, walau dikirim berdampingan dengan LoRA di hub.
- Kalau ragu, partner cloud sudah punya kombinasi yang benar pra-muat: pilih model dan LoRA, VAE dan ControlNet yang cocok sudah diatur otomatis.
Pemecahan masalah
Mengunduh "LoRA" tapi ukurannya 6 GB
Mengapa terjadi
Itu checkpoint; pengunggah memberi labelnya secara longgar.
Cara memperbaikinya
Masukkan ke folder checkpoints dan pilih sebagai model. Label katalog di sini dapat dipercaya.
Embedding tidak berfungsi
Mengapa terjadi
Keluarga salah (embedding SD 1.5 di SDXL), atau nama yang diketik tidak cocok dengan nama file.
Cara memperbaikinya
Cocokkan keluarga; ketik nama file tepat tanpa ekstensi; di ComfyUI pakai embedding:name.
ControlNet menghasilkan noise atau mengabaikan pose
Mengapa terjadi
ControlNet untuk keluarga lain, atau foto mentah yang dipakai bukan peta yang sudah diproses.
Cara memperbaikinya
Gunakan ControlNet yang dibuat untuk keluarga checkpoint dan jalankan node preprocessor dulu.
Warna terlihat pudar
Mengapa terjadi
VAE hilang atau salah.
Cara memperbaikinya
Muat VAE keluarga; di SDXL pakai fp16-fix VAE.
Model dimuat tapi menghasilkan gambar hitam
Mengapa terjadi
fp16 overflow di VAE atau checkpoint yang butuh --no-half-vae.
Cara memperbaikinya
Pakailah fp16-fix VAE atau flag no-half-vae; di Flux pastikan presisi text encoder cocok dengan build.
AD

Checkpoint, LoRA, embedding dan ControlNet, sudah terhubung
PirateDiffusion mengatur ribuan file model untukmu di GPU-nya sendiri; kamu sebut checkpoint dan tag LoRA lewat perintah Telegram dan VAE serta ControlNet yang cocok langsung dipakai. Generasi tanpa batas, harga tetap.
Pertanyaan
Mana yang harus diunduh pemula duluan?
Satu checkpoint dari keluarga yang ingin kamu pakai. LoRA datang kedua, setelah kamu tahu base mana yang kamu suka. Embedding dan ControlNet dipakai kalau ada masalah spesifik.
Bisakah saya menggabungkan LoRA ke checkpoint?
Bisa, setiap UI punya alat merge, hasilnya checkpoint baru. Menghemat node tapi bobotnya jadi tetap; kebanyakan orang tetap pisah LoRA.
Apakah fine-tune sama dengan LoRA?
Tidak. Fine-tune melatih ulang seluruh checkpoint (gigabyte); LoRA cuma tambahan kecil (megabyte). Banyak fine-tune awalnya LoRA yang digabung.
Apakah Flux dan Qwen pakai embedding?
Hampir tidak pernah. Text encoder LLM mereka tidak dilatih begitu; gaya dan konsep dikerjakan dengan LoRA.
Apa itu file workflow?
JSON ComfyUI yang menghubungkan komponen ini. Katalog mencantumkan beberapa sebagai "lain-lain"; isinya bukan bobot, cuma resep.
Tautan dan sumber
- LoRA paper (Hu et al., 2021)
- Textual inversion paper (Gal et al., 2022)
- ControlNet paper (Zhang et al., 2023)
- SDXL family page
- Upscalers family page
- PirateDiffusion
Model dalam panduan ini
Ditulis oleh
Quartermaster
Panduan terkait
Model
Apa itu LoRA dan cara menggunakannya di ComfyUI, Forge, Automatic1111, dan di cloud
Penjelasan LoRA untuk orang yang ingin hasil, bukan matematika: apa yang diubah file LoRA, kenapa harus cocok dengan keluarga model dasar, kata pemicu, bobot, menggabungkan beberapa LoRA, folder dan sintaks untuk tiap UI, dan cara mencoba LoRA di cloud sebelum mengunduh apa pun.
Oleh Captain
2026-05-20
Aplikasi
Cara memasang LoRA: folder, pengecekan file, dan penggunaan pertama di ComfyUI, Forge, Automatic1111, dan Draw Things
Panduan pemasangan praktis: dari mana mengunduh LoRA, cara cek hash file dengan halaman model, folder mana yang dipakai untuk setiap UI populer, cara menyegarkan daftar, cara memuat pertama kali, dan tiga cara menggunakan LoRA di cloud tanpa instal apa pun.
Oleh Lookout
2025-09-24
Model
Cara kerja model gambar AI generatif: difusi, latents, dan pengkode teks dijelaskan dengan sederhana
Mekanisme di balik Stable Diffusion, SDXL, Flux, dan model video tanpa matematika: apa hubungannya dengan noise, kenapa model bekerja di ruang latent yang terkompresi, apa fungsi pengkode teks dan VAE, apa yang benar-benar diubah oleh langkah dan panduan, serta kenapa data pelatihan menentukan apa yang bisa digambar model.
Oleh Quartermaster
2025-08-28
Prompting
ControlNet dijelaskan: pose, kedalaman, tepi, dan gambar referensi untuk SD 1.5, SDXL, dan Flux
Bagaimana ControlNet membuat model mengikuti pose, peta kedalaman, gambar tepi, atau coretan daripada menebak komposisi dari prompt: jenis kontrol umum dan kapan menggunakannya, langkah praprosesor, pengaturan kekuatan dan persentase akhir, file khusus keluarga, dan alternatif era Flux (Flux Depth, Canny, Kontext).
Oleh Captain
2026-02-18
Model
Memperbesar gambar AI: model ESRGAN, hires-fix, tiled diffusion dan kapan masing-masing tepat
Tiga keluarga metode memperbesar dan kegunaannya: pixel upscalers cepat (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) untuk pembesaran bersih, hires-fix untuk menambah detail saat pembuatan, dan tiled diffusion (Ultimate SD Upscale, SUPIR, berbasis Flux) untuk mengubah render 1024 menjadi cetakan 4K yang detail; dengan nilai denoise, ukuran tile, dan model yang layak diunduh.
Oleh Quartermaster
2026-03-04
Panduan lainnya
Layanan cloud
Biaya tetap vs token: mengapa paket tanpa batas seperti Graydient.ai adalah nilai terbaik untuk pembuat AI di 2026
Perbandingan biaya berperingkat, dengan harga dicek pada 8 Oktober 2026, dari paket tanpa batas biaya tetap seperti Graydient.ai melawan harga token dan kredit dari Midjourney, Leonardo, fal.ai, Replicate, Runway dan Kling: berapa biaya sebenarnya untuk 1.000 gambar dan 1.000 video per bulan di masing-masing, dan mengapa satu biaya tetap untuk gambar, video, audio, chat Grok LLM dan aplikasi web tanpa batas adalah nilai terbaik untuk pembuat yang sering mengulang.
Oleh Captain
2026-10-08
Model
FLUX.1 Dev: cara memberi prompt, pengaturan terbaik dan ide kreatif
Panduan praktis untuk FLUX.1 Dev dari Black Forest Labs: cara memberi prompt dengan bahasa alami, pengaturan panduan dan langkah, penumpukan LoRA, rendering teks, dan ide prompt yang memanfaatkan keunggulannya.
Oleh Captain
2026-09-30
Model
Stable Diffusion XL 1.0: prompt, pengaturan, dan apa yang masih terbaik
Cara mendapatkan hasil maksimal dari model dasar resmi SDXL 1.0: resolusi asli, pengaturan CFG dan sampler, refiner, prompt negatif, dan ide gaya di mana SDXL masih unggul.
Oleh Captain
2026-10-01
Model
Stable Diffusion 1.5: model klasik, dipicu dengan benar
Stable Diffusion 1.5 masih layak diketahui: resolusi yang tepat, CFG dan sampler, cara menggunakan perpustakaan besar LoRA dan embedding-nya, serta ide prompt kreatif yang cocok untuk model 512 piksel.
Oleh Captain
2026-10-02
Model
FLUX.2 Dev: memicu model terbaru Black Forest Labs
FLUX.2 Dev menghadirkan prompt yang lebih panjang, teks yang lebih baik, realisme yang lebih kuat, dan pengeditan multi-referensi. Panduan ini membahas alur kerja turbo, pengaturan panduan dan resolusi, struktur prompt, serta ide yang memanfaatkan kekuatan barunya.
Oleh Captain
2026-10-03
Model
Qwen-Image: prompt panjang, teks sempurna, dan poster bilingual
Qwen-Image adalah model yang tepat saat kata-kata dalam gambar penting. Pelajari cara menulis prompt deskriptif panjangnya, menghasilkan teks bahasa Inggris dan Cina dengan akurat, mengatur CFG dan langkah, serta mengeksplorasi ide kreatif dengan tata letak yang padat.
Oleh Captain
2026-09-29

Model
Trends
.ai
© ModelTrends.ai
|
© 2026
|
Hak cipta dilindungi