Memulakan penjanaan imej AI: gambar pertama anda dalam sepuluh minit
Topik: Perkhidmatan awan
Oleh Captain
Diterbitkan 2025-08-14
Permulaan mudah untuk pemula sepenuhnya: apa itu model, tiga cara untuk menjalankannya (aplikasi web, bot sembang, PC sendiri), cara menulis prompt pertama, maksud tetapan dan cara membezakan hasil yang baik dengan yang bernasib baik.
Gambaran keseluruhan
Penjanaan imej AI menukar ayat kepada gambar. Anda taipkan deskripsi (prompt), model yang telah belajar dari jutaan imej bercaption menukar bunyi rawak menjadi sesuatu yang sepadan dengan deskripsi itu, dan beberapa saat kemudian anda mendapat imej. Semua perkara lain dalam hobi ini,
LoRA
,
sampler
,
ControlNet
,
upscaler
, adalah penambahbaikan pada satu kitaran itu: terangkan, jana, lihat, laras.
Model adalah bahagian yang paling penting. Model berbeza ada kekuatan berbeza:
SDXL
dan fine-tune anime melukis ilustrasi dan watak,
Flux
dan
Z-Image
mengikuti prompt panjang dan menghasilkan teks yang boleh dibaca,
Wan
dan
LTX
buat video. ModelTrends.ai wujud untuk tunjuk model mana yang orang guna minggu ini, jadi anda tak perlu teka. Setiap halaman model tunjuk imej contoh dengan prompt dan tetapan tepat yang digunakan, cara paling cepat belajar.
Anda tak perlu PC gaming untuk mula. Gambar pertama paling cepat dibuat di perkhidmatan awan yang model sudah dipasang: aplikasi web seperti
BitVector
, di mana anda pilih model dan taip, atau bot sembang
PirateDiffusion
di Telegram, di mana anda hantar arahan. Menjalankan model pada kad grafik sendiri datang kemudian, bila anda dah tahu model mana yang anda suka dan sama ada nak belanja untuk hardware.
Rujukan
Nama | Jenis | Apakah ia |
|---|---|---|
Prompt | text | Apa yang anda nak lihat. Subjek dulu, kemudian suasana, kemudian gaya dan pencahayaan. Bahasa Inggeris biasa boleh guna pada model moden; senarai kata kunci guna pada model lama. |
Negative prompt | text | Apa yang anda tak nak (kabur, jari tambahan, tanda air). Penting pada SD 1.5 dan SDXL; kebanyakannya diabaikan oleh Flux dan model baru lain. |
Model / checkpoint | choice | Otaknya. Pilih dari senarai popular di laman ini; keluarga model tentukan rupa dan gaya prompt. |
Size | pixels | 512x512 untuk SD 1.5, 1024x1024 untuk SDXL dan Flux. Bentuk lain dengan jumlah piksel sama boleh guna (832x1216 potret, 1216x832 landskap). |
Steps | number | Berapa banyak kali penambahbaikan dibuat. 20 hingga 30 adalah biasa; lebih banyak lambat dan jarang lebih baik. |
CFG / guidance | number | Sejauh mana model ikut prompt. 5 hingga 7 pada SDXL, 3.5 pada Flux, 1 pada model turbo atau lightning. |
Seed | number | Bunyi mula. Seed sama dengan tetapan sama bagi gambar sama, jadi boleh ubah satu perkara pada satu masa. |
Sampler | choice | Matematik yang digunakan untuk buang bunyi. Euler atau DPM++ 2M Karras adalah pilihan selamat; halaman model tunjuk apa yang contoh guna. |
AD

Buat imej pertama tanpa pasang apa-apa
BitVector Prism adalah aplikasi web: pilih salah satu model dari laman ini, taip prompt dari contoh atas dan jana. Tak perlu muat turun, tak perlu konfigurasi, boleh guna di telefon.
Langkah demi langkah
- Buka pelayar model di laman ini dan susun ikut popular. Pilih model asas (checkpoint, bukan LoRA) dari keluarga SDXL atau Flux; fine-tune SDXL seperti DreamShaper XL atau Juggernaut XL mudah untuk cuba pertama kali.
- Baca halaman model: lihat tiga atau empat imej contoh dan prompt mereka. Perhatikan corak: subjek, suasana, pencahayaan, kamera, kata gaya.
- Tekan butang Run di halaman model. BitVector buka aplikasi web dengan model sudah dipilih; PirateDiffusion buka sembang Telegram di mana anda taip /render diikuti prompt anda.
- Tulis prompt pertama dengan salin contoh dan tukar hanya subjek. Kekalkan saiz, langkah dan sampler yang contoh guna.
- Jana empat imej, bukan satu. Bunyi rawak bermakna ada seed yang lebih baik; nilai model dengan satu gambar adalah silap.
- Tukar satu perkara: tambah kata pencahayaan (golden hour, soft studio light), atau kata kamera (35mm, close-up), dan jana lagi. Ini cara belajar buat prompt.
- Bintang model yang anda suka dengan hati pada kad; halaman Favs simpan dalam pelayar supaya boleh kembali tanpa akaun.
Contoh
Prompt pertama untuk model foto SDXL
a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo, shallow depth of field
Negative: blurry, deformed hands, watermark, text | 1216x832 | DPM++ 2M Karras | 28 steps | CFG 6
Idea sama di PirateDiffusion (Telegram)
/render <dreamshaper-xl> a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo [[blurry, watermark]] /size:1216x832 /steps:28
Prompt Flux (tiada negatif, panduan lebih rendah)
A candid photo of a fisherman mending a fishing net on a weathered pier at dawn. Soft fog over the water, warm low sun from the left, shallow depth of field, 35mm film look.
1216x832 | Euler | 24 steps | guidance 3.5
Petua
- Model adalah pengaruh terbesar, prompt kedua, tetapan ketiga. Pemula sering buat ikut urutan salah.
- Prompt pendek dan jelas lebih baik dari panjang dan kabur. "Basikal merah bersandar pada dinding putih, cahaya pagi, foto 50mm" lebih baik dari "indah menakjubkan hebat 8k masterpiece basikal".
- Bentuk potret untuk orang, bentuk landskap untuk suasana. Bentuk segi empat sama jarang jadi yang terbaik.
- Simpan prompt yang anda suka dalam fail teks. Setiap halaman model di sini tunjuk prompt penuh bawah contoh untuk sebab sama.
- Model anime dan ilustrasi (Illustrious, Pony, NoobAI) guna prompt gaya tag; model foto (Flux, Z-Image, fine-tune foto SDXL) guna ayat. Halaman keluarga terangkan yang mana.
- Jangan muat turun apa-apa sebelum guna model di awan dan suka. Checkpoint saiznya 2 hingga 24 GB setiap satu.
Penyelesaian masalah
Setiap imej nampak sama
Mengapa ia berlaku
Seed tetap, atau prompt senarai kata kualiti umum.
Cara membaikinya
Tetapkan seed ke rawak, buang "masterpiece, 8k, best quality" dari prompt foto, terangkan suasana sebaliknya.
Tangan dan muka salah
Mengapa ia berlaku
Muka dan tangan kecil pada resolusi rendah, atau model SD 1.5 lama.
Cara membaikinya
Guna SDXL atau Flux pada 1024 piksel, bingkai subjek lebih besar, atau cat semula muka kemudian (lihat panduan
inpainting
).
Gambar abaikan separuh prompt
Mengapa ia berlaku
Terlalu banyak idea dalam satu prompt, atau CFG terlalu rendah.
Cara membaikinya
Satu subjek, satu suasana, satu gaya setiap prompt. Tingkatkan CFG satu pada SDXL. Flux dan
Qwen
ikut prompt panjang lebih baik dari SD 1.5.
Teks dalam imej tak masuk akal
Mengapa ia berlaku
SD 1.5 dan SDXL tak boleh eja.
Cara membaikinya
Ambil masa minit setiap imej di laptop saya
Mengapa ia berlaku
Tiada GPU khusus, atau kad dengan kurang dari 6 GB memori.
Cara membaikinya
Jana di awan (BitVector, PirateDiffusion) dan guna laptop untuk lihat hasil.
AD

Ribuan model dalam tetingkap sembang
PirateDiffusion berjalan di Telegram: hantar /render dan prompt dan imej akan kembali dalam sembang. Setiap model dan LoRA di laman ini dengan butang Run sudah dipasang di sana, dengan harga tetap bulanan dan jana tanpa had.
Soalan
Perlukah saya bayar untuk cuba?
Kedua-dua rakan awan yang dipaut dari halaman model bagi anda mula tanpa pasang apa-apa; alat tempatan (ComfyUI,
Forge
) percuma tapi perlukan kad grafik dengan sekurang-kurangnya 8 GB memori untuk model sekarang.
Model mana yang sesuai untuk pemula?
Fine-tune SDXL untuk ilustrasi atau model dev Flux untuk foto. Panduan "model mana nak cuba dulu" di laman ini beri ranking dengan sebab.
Adakah LoRA itu model?
LoRA adalah tambahan yang ubah model asas. Anda perlu model asas (checkpoint) dulu; LoRA letak atasnya. Panduan LoRA terangkan.
Boleh buat video juga?
Boleh, dengan Wan,
LTX-2
dan
MiniMax H3
antara lain, tapi video perlukan memori jauh lebih banyak secara tempatan. Mula di awan; panduan mula video ada di sini.
Adakah imej itu milik saya?
Lesen berbeza ikut model; halaman model paut ke lesen. Kebanyakan model terbuka benarkan guna peribadi dan komersial, beberapa lesen khusus penyelidikan (build dev awal Flux) tidak.
Kenapa hasil saya nampak kurang bagus dari contoh?
Biasanya saiz, sampler atau bilangan langkah berbeza. Salin tetapan contoh tepat dulu, kemudian ubah satu perkara pada satu masa.
Pautan dan sumber
- Models browser (sort by hot)
- Weekly ranking
- BitVector web app
- PirateDiffusion on Telegram
- SDXL family page
- Flux family page
Model dalam panduan ini
Ditulis oleh
Captain
Panduan berkaitan
Model
Model imej AI mana nak cuba dulu, dan kenapa: senarai permulaan mengikut kedudukan
Tujuh model untuk minggu pertama, dipilih sebab mudah digunakan bukan sebab popular: satu SDXL foto fine-tune, satu anime fine-tune, Flux dev, model turbo laju, model inpainting, model video dan upscaler, setiap satu dengan sebab, memori yang diperlukan dan gaya prompt yang dijangka.
Oleh Captain
2025-09-10
Prompting
Asas penulisan prompt untuk imej AI: struktur, susunan, berat dan dua dialek prompt
Cara menulis prompt yang berkesan pada percubaan pertama: susunan subjek-latar-gaya, kenapa kedudukan perkataan penting, dialek tag model anime SDXL berbanding dialek ayat Flux dan Qwen, berat perhatian, had panjang prompt dan senarai semak untuk membetulkan prompt yang diabaikan.
Oleh Captain
2025-10-22
Model
Bagaimana model imej AI generatif berfungsi: penjelasan mudah tentang difusi, latens dan pengekod teks
Mekanisme di sebalik Stable Diffusion, SDXL, Flux dan model video tanpa matematik: apa kaitan bunyi dengan proses ini, kenapa model berfungsi dalam ruang latens yang dimampatkan, apa fungsi pengekod teks dan VAE, apa yang benar-benar berubah dengan langkah dan panduan, dan kenapa data latihan menentukan apa yang model boleh lukis.
Oleh Quartermaster
2025-08-28
Model
Apa itu LoRA dan cara menggunakannya di ComfyUI, Forge, Automatic1111 dan di awan
Penjelasan LoRA untuk orang yang mahu hasil, bukan matematik: apa yang diubah oleh fail LoRA, kenapa ia mesti sepadan dengan keluarga model asas, kata pencetus, berat, menumpuk beberapa LoRA, folder dan sintaks untuk setiap UI, dan cara cuba LoRA di awan sebelum memuat turun apa-apa.
Oleh Captain
2026-05-20
Perkhidmatan awan
PirateDiffusion: jalankan mana-mana model dari Telegram, tiada GPU diperlukan
Perintah penting dalam bot Telegram PirateDiffusion: /render dengan kata pencetus model, pemberatan (( )) dan [[ ]], #recipes, /adetailer, peningkatan /highdef dan /facelift, /remix, /inpaint, aliran kerja ComfyUI dengan /wf /run:, dan kemahiran baru // yang memilih model untuk kamu.
Oleh Captain
2026-10-03
Lagi panduan
Model
FLUX.1 Dev: cara memberi arahan, tetapan terbaik dan idea kreatif
Panduan praktikal untuk FLUX.1 Dev oleh Black Forest Labs: cara memberi arahan dalam bahasa biasa, tetapan panduan dan langkah, penumpukan LoRA, rendering teks dan idea arahan yang memanfaatkan kekuatannya.
Oleh Captain
2026-09-30
Model
Stable Diffusion XL 1.0: prompt, tetapan dan apa yang masih terbaik
Cara untuk dapatkan hasil terbaik dari model asas rasmi SDXL 1.0: resolusi asli, tetapan CFG dan sampler, refiner, prompt negatif dan idea gaya di mana SDXL masih menonjol.
Oleh Captain
2026-10-01
Model
Stable Diffusion 1.5: model klasik, dipandu dengan betul
Stable Diffusion 1.5 masih patut diketahui: resolusi yang betul, CFG dan sampler, cara guna perpustakaan besar LoRA dan embeddingnya, serta idea prompt kreatif yang sesuai untuk model 512-piksel.
Oleh Captain
2026-10-02
Model
FLUX.2 Dev: memicu model terbaru Black Forest Labs
FLUX.2 Dev membawa prompt yang lebih panjang, teks yang lebih baik, realisme yang lebih kuat dan penyuntingan multi-rujukan. Panduan ini merangkumi aliran kerja turbo, tetapan panduan dan resolusi, struktur prompt dan idea yang menggunakan kekuatan barunya.
Oleh Captain
2026-10-03
Model
Qwen-Image: arahan panjang, teks sempurna dan poster dwibahasa
Qwen-Image adalah model yang sesuai bila perkataan dalam gambar penting. Pelajari cara menulis arahan panjang yang terperinci, hasilkan teks Inggeris dan Cina dengan tepat, tetapkan CFG dan langkah, serta terokai idea kreatif yang berat pada susun atur.
Oleh Captain
2026-09-29
Model
SDXL-Lightning: penjanaan empat langkah pada mana-mana checkpoint SDXL
LoRA SDXL-Lightning dari ByteDance menukar render SDXL 30 langkah menjadi hanya 4 langkah. Ketahui bilangan langkah, CFG yang perlu digunakan, sampler, dan cara gabungkan dengan checkpoint dan LoRA gaya kegemaran kamu.
Oleh Captain
2026-09-30

Model
Trends
.ai
© ModelTrends.ai
|
Dibuat di Jepun
|
© 2026