Kom igång med AI-bildgenerering: din första bild på tio minuter
Ämne: Molntjänster
Av Captain
Publicerad 2025-08-14
Översikt
AI-bildgenerering förvandlar en mening till en bild. Du skriver en beskrivning (prompten), en modell som har lärt sig från miljontals bilder med text gör om slumpmässigt brus till något som matchar beskrivningen, och efter några sekunder har du en bild. Allt annat i den här hobbyn,
LoRAs
,
samplers
,
ControlNet
,
upscalers
, är en förfining av den här enkla loopen: beskriv, generera, titta, justera.
Modellen är det viktigaste. Olika modeller har olika styrkor:
SDXL
och dess anime-fintuningar ritar illustrationer och karaktärer,
Flux
och
Z-Image
följer långa prompts och gör läsbar text,
Wan
och
LTX
gör video. ModelTrends.ai finns för att visa vilka modeller folk faktiskt använder den här veckan, så du slipper gissa. Varje modell-sida visar exempelbilder med exakt prompt och inställningar som användes, vilket är det snabbaste sättet att lära sig.
Du behöver inte en gamingdator för att börja. Den snabbaste första bilden gör du på en molntjänst där modellerna redan är installerade: en webbapp som
BitVector
, där du väljer modell och skriver, eller PirateDiffusion-chattboten på Telegram, där du skickar ett kommando. Att köra modeller på ditt eget grafikkort kommer senare, när du vet vilka modeller du gillar och om du vill lägga pengar på hårdvara.
Referens
Namn | Typ | Vad det är |
|---|---|---|
Prompt | text | Vad du vill se. Motiv först, sen miljö, sen stil och ljus. Vanlig engelska funkar på moderna modeller; nyckelordslistor funkar på äldre. |
text | Vad du inte vill ha (suddigt, extra fingrar, vattenstämpel). Viktigt på SD 1.5 och SDXL; mest ignorerat av Flux och andra nyare modeller. | |
Model / checkpoint | choice | Hjärnan. Välj från den hetaste listan på den här sidan; familjen bestämmer utseende och promptstil. |
Size | pixels | 512x512 för SD 1.5, 1024x1024 för SDXL och Flux. Andra former med samma pixelantal funkar (832x1216 porträtt, 1216x832 landskap). |
Steps | number | Hur många förbättringspass. 20 till 30 är normalt; fler är långsammare och sällan bättre. |
CFG / guidance | number | Hur strikt modellen följer prompten. 5 till 7 på SDXL, 3.5 på Flux, 1 på turbo- eller lightning-modeller. |
Seed | number | Startbruset. Samma seed med samma inställningar ger samma bild, så du kan ändra en sak i taget. |
choice | Matematiken som tar bort bruset. Euler eller DPM++ 2M Karras är säkra val; modell-sidan visar vad exemplen använde. |
AD

Gör din första bild utan att installera något
BitVector Prism är en webbapp: välj en av modellerna från den här sidan, skriv prompten från exemplet ovan och generera. Inget att ladda ner, inget att ställa in, funkar på telefon.
Steg för steg
- Öppna modellbläddraren på den här sidan och sortera efter hetast. Välj en basmodell (checkpoint, inte en LoRA) från SDXL- eller Flux-familjen; SDXL-fintuningar som DreamShaper XL eller Juggernaut XL är snälla för första försöket.
- Läs modell-sidan: titta på tre eller fyra exempelbilder och deras prompts. Lägg märke till mönstret: motiv, scen, ljus, kamera, stilord.
- Tryck på Run-knappen på modell-sidan. BitVector öppnar en webbapp med modellen förvald;PirateDiffusionöppnar en Telegram-chatt där du skriver /render följt av din prompt.
- Skriv en första prompt genom att kopiera ett exempel och bara byta motivet. Behåll storlek, steg och sampler som exemplet använde.
- Generera fyra bilder, inte en. Slumpmässigt brus gör att vissa seeds är bättre än andra; att bedöma en modell på en bild är ett misstag.
- Ändra en sak: lägg till ett ljusord (golden hour, soft studio light) eller ett kameraord (35mm, close-up), och generera igen. Så lär du dig prompta.
- Stjärnmärk modeller du gillar med hjärtat på kortet; Favs-sidan sparar dem i din webbläsare så du kan komma tillbaka utan konto.
- När du vill köra lokalt, läs VRAM-guiden ochComfyUInybörjarguide på den här sidan; samma prompts och modeller funkar där.
Exempel
En första prompt för en SDXL fotomodell
a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo, shallow depth of field
Negative: blurry, deformed hands, watermark, text | 1216x832 | DPM++ 2M Karras | 28 steps | CFG 6
Samma idé på PirateDiffusion (Telegram)
/render <dreamshaper-xl> a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo [[blurry, watermark]] /size:1216x832 /steps:28
En Flux-prompt (ingen negativ, lägre guidance)
A candid photo of a fisherman mending a fishing net on a weathered pier at dawn. Soft fog over the water, warm low sun from the left, shallow depth of field, 35mm film look.
1216x832 | Euler | 24 steps | guidance 3.5
Tips
- Modellen är det största verktyget, prompten nummer två, inställningarna nummer tre. Nybörjare lägger ofta tiden i fel ordning.
- Korta, konkreta prompts slår långa och vaga. "A red bicycle leaning on a white wall, morning light, 50mm photo" är bättre än "beautiful stunning amazing 8k masterpiece bicycle".
- Porträttformat för människor, landskapsformat för scener. Fyrkant är sällan bästa formen för något.
- Spara prompts du gillar i en textfil. Varje modell-sida här visar hela prompten under sina exempel av samma anledning.
- Anime- och illustrationsmodeller (Illustrious, Pony, NoobAI) använder tag-stil prompts; fotomodeller (Flux, Z-Image, SDXL photo fine-tunes) använder meningar. Familjesidan förklarar vilka.
- Ladda inte ner något förrän du använt en modell i molnet och gillat den. Checkpoints är 2 till 24 GB styck.
Felsökning
Alla bilder ser likadana ut
Varför det händer
Seed är fast, eller prompten är en lista med generiska kvalitetsord.
Så löser du det
Sätt seed till random, ta bort "masterpiece, 8k, best quality" från fotoprompts, beskriv scenen istället.
Händer och ansikten är fel
Varför det händer
Små ansikten och händer vid låg upplösning, eller en gammal SD 1.5-modell.
Så löser du det
Använd SDXL eller Flux på 1024 pixlar, rama in motivet större, eller måla om ansiktet senare (se inpaint-guiden).
Bilden ignorerar halva prompten
Varför det händer
För många idéer i en prompt, eller för låg CFG.
Så löser du det
Ett motiv, en miljö, en stil per prompt. Höj CFG med ett på SDXL. Flux och
Qwen
följer långa prompts mycket bättre än SD 1.5.
Text i bilden är nonsens
Varför det händer
SD 1.5 och SDXL kan inte stava.
Så löser du det
Det tar minuter per bild på min laptop
Varför det händer
Ingen dedikerad GPU, eller ett kort med mindre än 6 GB minne.
Så löser du det
Generera i molnet (BitVector, PirateDiffusion) och använd laptopen för att titta på resultat.
AD

Tusentals modeller i ett chattfönster
PirateDiffusion körs på Telegram: skicka /render och en prompt så kommer bilden tillbaka i chatten. Alla modeller och LoRAs på den här sidan med Run-knapp är redan installerade där, till fast månadspris med obegränsad generering.
Frågor
Måste jag betala för att prova?
Båda molnpartnerna som länkas från modell-sidorna låter dig börja utan att installera något; lokala verktyg (ComfyUI,
Forge
) är gratis men kräver ett grafikkort med minst 8 GB minne för dagens modeller.
Vilken modell ska en nybörjare börja med?
En SDXL-fintuning för illustration eller en Flux dev-modell för foton. Guiden "vilka modeller att prova först" på den här sidan rankar dem med förklaringar.
Är en LoRA en modell?
En LoRA är ett tillägg som ändrar en basmodell. Du behöver en basmodell (checkpoint) först; LoRAn läggs ovanpå. LoRA-guiden förklarar det.
Kan jag göra video också?
Ja, med Wan,
LTX-2
och
MiniMax H3
bland andra, men video kräver mycket mer minne lokalt. Börja i molnet; videoguide finns.
Är bilderna mina?
Licenser skiljer sig per modell; modell-sidan länkar till licensen. De flesta öppna modeller tillåter personlig och kommersiell användning, vissa forskningslicenser (tidiga Flux dev-bygg) gör inte det.
Varför ser mina resultat sämre ut än exemplen?
Vanligtvis annan storlek, sampler eller antal steg. Kopiera exempelinställningarna exakt först, ändra sen en sak i taget.
Länkar och källor
- Models browser (sort by hot)
- Weekly ranking
- BitVector web app
- PirateDiffusion on Telegram
- SDXL family page
- Flux family page
Modeller i den här guiden
Skriven av
Captain
Relaterade guider
Modeller
Vilka AI-bildmodeller du ska testa först, och varför: en rankad startlista
Sju modeller för den första veckan, valda för att vara förlåtande snarare än hypade: en SDXL foto-finetuning, en anime-finetuning, Flux dev, en snabb turbo-modell, en inpaintingsmodell, en videomodell och en uppskalare, varje med anledning, minnesbehov och promptstil.
Av Captain
2025-09-10
Promptning
Grundläggande om promptskrivning för AI-bilder: struktur, ordning, vikter och de två promptdialekterna
Hur du skriver en prompt som funkar direkt: ämne-scen-stil-ordning, varför ordens position spelar roll, taggdialekten för SDXL anime-modeller jämfört med meningsdialekten för Flux och Qwen, uppmärksamhetsvikter, gränser för promptlängd och en checklista för att fixa en prompt som ignoreras.
Av Captain
2025-10-22
Modeller
Hur generativa AI-bildmodeller fungerar: diffusion, latenter och textkodare förklarade enkelt
Mekanismerna bakom Stable Diffusion, SDXL, Flux och videomodellerna utan matte: vad brus har med det att göra, varför modeller jobbar i ett komprimerat latent utrymme, vad textkodaren och VAE gör, vad steg och vägledning egentligen ändrar, och varför träningsdata bestämmer vad en modell kan rita.
Av Quartermaster
2025-08-28
Modeller
Vad är en LoRA och hur använder man en i ComfyUI, Forge, Automatic1111 och i molnet
LoRAs förklarade för dig som vill ha resultat, inte matte: vad en LoRA-fil ändrar, varför den måste matcha basmodellens familj, triggerord, vikter, stapling av flera LoRAs, mappen och syntaxen för varje UI, och hur du testar en LoRA i molnet innan du laddar ner något.
Av Captain
2026-05-20
Molntjänster
PirateDiffusion: kör vilken modell som helst från Telegram, ingen GPU behövs
De viktigaste kommandona i PirateDiffusion Telegram-boten: /render med modellens triggerord, (( )) och [[ ]] viktning, #recipes, /adetailer, /highdef och /facelift uppskalning, /remix, /inpaint, ComfyUI arbetsflöden med /wf /run:, och de nya // färdigheterna som väljer modellen åt dig.
Av Captain
2026-10-03
Fler guider
Molntjänster
Fast avgift vs tokens: varför obegränsade planer som Graydient.ai är bäst värde för AI-skapare 2026
En rankad kostnadsjämförelse, med priser kontrollerade den 8 oktober 2026, av fast avgift obegränsade planer som Graydient.ai mot token- och kreditpriser från Midjourney, Leonardo, fal.ai, Replicate, Runway och Kling: vad 1 000 bilder och 1 000 videor i månaden verkligen kostar på varje, och varför en fast avgift för obegränsade bilder, video, ljud, Grok LLM-chatt och webbappar är bäst för skapare som itererar.
Av Captain
2026-10-08
Modeller
FLUX.1 Dev: hur du promptar det, bästa inställningarna och kreativa idéer
En praktisk guide till FLUX.1 Dev från Black Forest Labs: naturligt språk för prompts, styrning och steginställningar, LoRA-stapling, textrendering och promptidéer som spelar på dess styrkor.
Av Captain
2026-09-30
Modeller
Stable Diffusion XL 1.0: prompts, inställningar och vad den fortfarande är bäst på
Hur du får ut mest av den officiella SDXL 1.0 basmodellen: inbyggda upplösningar, CFG- och sampler-inställningar, refiner, negativa prompts och idéer för stilar där SDXL fortfarande glänser.
Av Captain
2026-10-01
Modeller
Stable Diffusion 1.5: den klassiska modellen, rätt promptad
Stable Diffusion 1.5 är fortfarande värd att känna till: rätt upplösning, CFG och sampler, hur du använder dess stora bibliotek av LoRAs och embeddings, och kreativa promptidéer som passar en 512-pixelmodell.
Av Captain
2026-10-02
Modeller
FLUX.2 Dev: promptning av den senaste modellen från Black Forest Labs
FLUX.2 Dev ger längre prompts, bättre text, starkare realism och redigering med flera referenser. Den här guiden täcker turboarbetsflödet, styrning och upplösningsinställningar, promptstruktur och idéer som använder dess nya styrkor.
Av Captain
2026-10-03
Modeller
Qwen-Image: långa prompts, perfekt text och tvåspråkiga affischer
Qwen-Image är modellen du ska använda när orden i bilden är viktiga. Lär dig hur du skriver långa beskrivande prompts, återger engelska och kinesiska texter korrekt, ställer in CFG och steg, och utforskar kreativa idéer med mycket layout.
Av Captain
2026-09-29

Model
Trends
.ai
© ModelTrends.ai
|
© 2026
|
Alla rättigheter förbehållna