Meningkatkan imej AI: model ESRGAN, hires-fix, penyebaran bertiles dan bila setiap satu sesuai
Topik: Model
Oleh Quartermaster
Diterbitkan 2026-03-04
Tiga keluarga peningkatan dan kegunaannya: penambah piksel pantas (4x-UltraSharp, Real-ESRGAN, SwinIR, DAT) untuk pembesaran bersih, hires-fix untuk menambah butiran semasa penjanaan, dan penyebaran bertiles (Ultimate SD Upscale, SUPIR, berasaskan Flux) untuk menukar render 1024 menjadi cetakan 4K yang terperinci; dengan nilai denoise, saiz tile dan model yang patut dimuat turun.
Gambaran keseluruhan
Model imej melukis dengan baik pada saiz asal mereka (512 untuk
SD 1.5
, 1024 untuk
SDXL
dan
Flux
) dan buruk jauh melebihi itu, jadi cara untuk mendapatkan imej besar adalah menjana pada saiz asal dan membesarkan selepas itu. Ada tiga cara untuk membesarkan, dan ia tidak boleh ditukar ganti. Penambah piksel adalah rangkaian kecil (keluarga ESRGAN, SwinIR, DAT) yang menajamkan sambil menukar saiz; mereka pantas, setia dan tidak menambah kandungan baru. Hires-fix adalah laluan penyebaran kedua pada saiz lebih besar semasa penjanaan yang menambah butiran sebenar dengan denoise sederhana. Penyebaran bertiles memotong imej besar kepada tiles bertindih dan menjalankan
img2img
pada setiap satu, yang boleh mencipta butiran munasabah pada 4K dan lebih, dipandu oleh Tile
ControlNet
supaya tiles kekal setia.
Yang mana satu kamu perlukan bergantung pada tujuan. Untuk web dan sosial, peningkatan piksel 2x pada render bersih sudah cukup dan mengambil masa dua saat. Untuk cetakan, produk dan wallpaper, peningkatan piksel ke 2x diikuti oleh laluan penyebaran bertiles dengan denoise rendah memberi butiran yang orang jangka dari "seni AI 4K". Hires-fix berada di tengah dan adalah lalai dalam
Forge
dan A1111 atas sebab: ia membetulkan muka 1024 yang kabur tanpa aliran kerja kedua.
Keluarga
Upscalers
di laman ini menyenaraikan penambah piksel dengan kegunaan mereka (foto, anime, muka, teks) dan penambah berasaskan penyebaran dengan keluarga asas mereka. Rakan awan menjalankan alat yang sama:
PirateDiffusion
ada arahan /upscale dan /enhance,
BitVector
ada butang upscale di sebelah setiap hasil.
Rujukan
Nama | Jenis | Apakah ia |
|---|---|---|
4x-UltraSharp | pixel upscaler, ESRGAN | Lalai untuk foto dan render: tajam, sedikit rangup; skala turun ke 2x selepas itu untuk rupa semula jadi. |
Real-ESRGAN x4plus / x4plus-anime | pixel upscaler | Tujuan umum yang kukuh; varian anime mengekalkan garis bersih pada ilustrasi. |
4x-NMKD-Siax, 4x-Foolhardy-Remacri | pixel upscaler | Alternatif lebih lembut kepada UltraSharp; Remacri untuk foto lembut, Siax untuk tekstur terperinci. |
SwinIR / DAT / HAT | pixel upscaler, transformer | Fideliti lebih tinggi, lebih perlahan; terbaik untuk gambar di mana ESRGAN mencipta tekstur. |
Hires-fix | generation setting | Tingkatkan 1.5-2x dengan penambah piksel kemudian denoise 0.3-0.5 pada saiz baru. Kotak semak A1111/Forge; ComfyUI sebagai KSampler kedua. |
Ultimate SD Upscale | tiled diffusion | Tiles 1024 dengan tumpang tindih 64 px, denoise 0.2-0.35, Tile ControlNet aktif. Tukar 2048 ke 4096 dengan butiran baru. |
SUPIR / Flux tiled / SeedVR | diffusion restorers | Model berat yang memulihkan dan menambah imej lama atau berkualiti rendah; 16 GB+ dan beberapa minit setiap imej. |
Denoise | 0.2-0.5 | Dalam mana-mana peningkatan penyebaran, berapa banyak yang boleh berubah. 0.2 kekalkan semua; 0.5 lukis semula tekstur dan mungkin ubah muka. |
AD

Peningkatan satu klik
Setiap imej yang kamu buat dalam BitVector Prism ada butang Upscale yang jalankan penambah sesuai untuk model; hasil dimuat turun pada 2x atau 4x. Tiada fail model perlu dikumpul.
Langkah demi langkah
- Jana pada saiz asal dan betulkan komposisi dan muka dulu (inpainting); peningkatan membesar-besarkan kecacatan bukan membetulkannya.
- Jalan cepat: Upscale Image (menggunakan Model) dengan 4x-UltraSharp, kemudian Image Scale ke 2x asal. Siap dalam beberapa saat; bagus untuk web.
- Jalan hires-fix (Forge, A1111): aktifkan Hires. fix, penambah 4x-UltraSharp atau Latent, tingkatkan 1.5-2, langkah hires 15, denoise 0.4. Dalam ComfyUI: Upscale Latent By 1.5 -> KSampler kedua pada denoise 0.45.
- Jalan cetak: tingkatkan piksel ke 2x, kemudian Ultimate SD Upscale dengancheckpointsama, tile 1024, padding 32, denoise 0.25, kekuatan Tile ControlNet 0.6, pembetulan sambungan "half tile". Jangka beberapa minit.
- Muka: selepas peningkatan jalankan laluan perincian muka (ADetailer, nod FaceDetailer) pada denoise 0.35; imej besar buat muka kecil jadi besar semula.
- Tajamkan ringan dan eksport sebagai PNG untuk cetakan, WebP atau JPEG 92 untuk web. Bandingkan dengan render 1x pada 100 peratus untuk kesan artefak yang dicipta.
- Di awan: balas hasil PirateDiffusion dengan /upscale (piksel) atau /enhance (penyebaran); dalam BitVector tekan Upscale pada kad imej.
Contoh
ComfyUI cepat 2x
VAE Decode -> Upscale Image (using Model: 4x-UltraSharp) -> Image Scale (0.5, lanczos) -> Save Image
Tetapan hires-fix Forge
Hires. fix: upscaler 4x-UltraSharp | upscale by 1.5 | hires steps 15 | denoising strength 0.4 | same seed
Ultimate SD Upscale untuk cetakan
Input 2048x2048 (after 2x pixel upscale) | upscale_by 2 | tile 1024x1024 | mask blur 16 | padding 32 | denoise 0.25 | ControlNet Tile 0.6 | seam fix half tile
Petua
- Tingkatkan yang akhir, bukan setiap draf; laluan 4x pada render 1024 adalah 16 juta piksel dan ambil masa sebenar.
- Model ESRGAN dilatih untuk 4x; menjalankannya pada 2x bermakna 4x kemudian skala turun, sebab itu output nampak terlalu tajam bila kamu langkau skala turun.
- Anime dan ilustrasi rata perlukan varian anime atau garis jadi dua; foto perlukan SwinIR, DAT atau Remacri atau kulit jadi plastik.
- Dalam penyebaran bertiles jaga prompt pendek dan umum ("terperinci tinggi, fokus tajam, kulit semula jadi") supaya tiada tile cipta subjek baru.
- Peningkatan latent dalam hires-fix perlukan denoise 0.5+ untuk tajam; penambah piksel dalam hires-fix berfungsi pada 0.3-0.4 dan kekalkan imej lebih dekat dengan asal.
- Halaman keluarga Upscalers susun mengikut popular; tiga teratas tutup 90 peratus keperluan.
Penyelesaian masalah
Imej yang ditingkatkan nampak terlalu tajam dan rangup
Mengapa ia berlaku
Output 4x ESRGAN kekal pada 4x.
Cara membaikinya
Skala turun ke 2x, atau guna Remacri/SwinIR.
Muka berubah selepas laluan bertiles
Mengapa ia berlaku
Denoise terlalu tinggi; tiles cipta semula muka.
Cara membaikinya
Denoise 0.2-0.25, Tile ControlNet aktif, perincian muka selepas itu.
Sambungan grid kelihatan
Mengapa ia berlaku
Tumpang tindih rendah atau tiada pembetulan sambungan.
Cara membaikinya
Padding 32-64, mod pembetulan sambungan, atau SUPIR untuk pemulihan satu laluan.
Hires-fix hasilkan anggota berganda
Mengapa ia berlaku
Faktor peningkatan atau denoise terlalu tinggi untuk model.
Cara membaikinya
Tingkatkan maksimum 1.5, denoise 0.4, atau guna penambah piksel bukan latent.
Kehabisan memori pada langkah decode
Mengapa ia berlaku
VAE decode saiz penuh imej 4K.
Cara membaikinya
VAE Decode (Tiled) dan tiles lebih kecil.
AD

/upscale dan /enhance dari chat
Balas mana-mana render PirateDiffusion dengan /upscale untuk 4x bersih atau /enhance untuk laluan penyebaran bertiles dengan butiran baru. GPU server buat kerja berat; laluan tanpa had dengan harga tetap.
Soalan
Penambah mana yang terbaik?
4x-UltraSharp untuk kebanyakan render, Real-ESRGAN anime untuk ilustrasi, SwinIR atau DAT untuk foto. Halaman keluarga Upscalers susun mengikut kegunaan.
Adakah peningkatan betulkan tangan buruk?
Tidak; ia membesarkan tangan. Inpaint dulu, tingkatkan kemudian.
Boleh pergi sebesar mana?
Penambah piksel ke mana-mana saiz; penyebaran bertiles ke 8K dengan kesabaran. Lebih dari 4x model cipta lebih daripada yang disimpan.
Adakah hires-fix sama dengan peningkatan?
Ia peningkatan dengan laluan penyebaran dalam penjanaan; ia tambah butiran, penambah biasa tidak.
Boleh saya tingkatkan video?
Boleh: bingkai demi bingkai dengan ESRGAN (pantas, risiko berkelip) atau dengan pemulih video seperti SeedVR; panduan video ada.
Pautan dan sumber
- Real-ESRGAN
- Ultimate SD Upscale for ComfyUI
- OpenModelDB (upscaler catalogue)
- Upscalers family page
- PirateDiffusion
- BitVector web app
Model dalam panduan ini
Ditulis oleh
Quartermaster
Panduan berkaitan
Prompting
asas img2img, inpainting dan outpainting: membaiki tangan, menukar objek dan meluaskan gambar
Tiga cara untuk menjana dari gambar sedia ada dan bukan dari bunyi bising: img2img untuk menukar gaya dengan nilai denoise, inpainting untuk mengecat semula hanya kawasan bertopeng (cara biasa membaiki tangan dan muka), dan outpainting untuk meluaskan kanvas; dengan pilihan denoise, padding dan model untuk SD 1.5, SDXL, Flux Fill dan Qwen Image Edit.
Oleh Captain
2025-12-03
Prompting
ControlNet diterangkan: pose, kedalaman, tepi dan imej rujukan untuk SD 1.5, SDXL dan Flux
Bagaimana ControlNet membuat model mengikuti pose, peta kedalaman, lukisan tepi atau coretan dan bukannya meneka komposisi dari prompt: jenis kawalan biasa dan bila nak guna setiap satu, langkah prapemproses, tetapan kekuatan dan peratus tamat, fail khusus keluarga, dan alternatif era Flux (Flux Depth, Canny, Kontext).
Oleh Captain
2026-02-18
Model
Krea2 Enhancer: detail dan pencahayaan lebih bersih untuk mana-mana gaya Krea 2
Krea2 Enhancer LoRA oleh vrgamedevgirl memperbaiki imej Krea 2 dalam gaya realistik, anime, produk dan fantasi tanpa mengubah maksud prompt. Ketahui berat, aliran kerja dan idea.
Oleh Captain
2026-09-30
Prompting
Langkah, CFG, sampler, penjadual dan benih: tetapan penjanaan dijelaskan dengan nilai selamat
Apa yang setiap tetapan dalam panel penjanaan ubah, nilai yang sesuai untuk setiap keluarga model (SD 1.5, SDXL, Flux, Qwen, Z-Image, Wan), sampler mana yang patut diketahui, kenapa model distilasi pecahkan peraturan biasa, dan cara guna benih untuk ubah satu perkara pada satu masa.
Oleh Quartermaster
2025-11-19
Model
LTX 2.3 Crisp Enhance: detail video lebih tajam dan sinematik
Crisp Enhance LoRA oleh vrgamedevgirl untuk LTX 2.3 tingkatkan ketajaman, detail mikro dan kontras dalam video yang dijana. Pelajari cara seimbangkan dengan Soft Enhance, berat dan idea prompt.
Oleh Captain
2026-10-03
Lagi panduan
Model
FLUX.1 Dev: cara memberi arahan, tetapan terbaik dan idea kreatif
Panduan praktikal untuk FLUX.1 Dev oleh Black Forest Labs: cara memberi arahan dalam bahasa biasa, tetapan panduan dan langkah, penumpukan LoRA, rendering teks dan idea arahan yang memanfaatkan kekuatannya.
Oleh Captain
2026-09-30
Model
Stable Diffusion XL 1.0: prompt, tetapan dan apa yang masih terbaik
Cara untuk dapatkan hasil terbaik dari model asas rasmi SDXL 1.0: resolusi asli, tetapan CFG dan sampler, refiner, prompt negatif dan idea gaya di mana SDXL masih menonjol.
Oleh Captain
2026-10-01
Model
Stable Diffusion 1.5: model klasik, dipandu dengan betul
Stable Diffusion 1.5 masih patut diketahui: resolusi yang betul, CFG dan sampler, cara guna perpustakaan besar LoRA dan embeddingnya, serta idea prompt kreatif yang sesuai untuk model 512-piksel.
Oleh Captain
2026-10-02
Model
FLUX.2 Dev: memicu model terbaru Black Forest Labs
FLUX.2 Dev membawa prompt yang lebih panjang, teks yang lebih baik, realisme yang lebih kuat dan penyuntingan multi-rujukan. Panduan ini merangkumi aliran kerja turbo, tetapan panduan dan resolusi, struktur prompt dan idea yang menggunakan kekuatan barunya.
Oleh Captain
2026-10-03
Model
Qwen-Image: arahan panjang, teks sempurna dan poster dwibahasa
Qwen-Image adalah model yang sesuai bila perkataan dalam gambar penting. Pelajari cara menulis arahan panjang yang terperinci, hasilkan teks Inggeris dan Cina dengan tepat, tetapkan CFG dan langkah, serta terokai idea kreatif yang berat pada susun atur.
Oleh Captain
2026-09-29
Model
SDXL-Lightning: penjanaan empat langkah pada mana-mana checkpoint SDXL
LoRA SDXL-Lightning dari ByteDance menukar render SDXL 30 langkah menjadi hanya 4 langkah. Ketahui bilangan langkah, CFG yang perlu digunakan, sampler, dan cara gabungkan dengan checkpoint dan LoRA gaya kegemaran kamu.
Oleh Captain
2026-09-30

Model
Trends
.ai
© ModelTrends.ai
|
Dibuat di Jepun
|
© 2026