Erste Schritte mit KI-Bilderzeugung: Dein erstes Bild in zehn Minuten
Thema: Cloud-Dienste
Von Captain
Veröffentlicht am 2025-08-14
Überblick
KI-Bilderzeugung verwandelt einen Satz in ein Bild. Du gibst eine Beschreibung ein (den Prompt), ein Modell, das aus Millionen beschrifteter Bilder gelernt hat, verwandelt zufälliges Rauschen in etwas, das zur Beschreibung passt, und nach ein paar Sekunden hast du ein Bild. Alles andere in diesem Hobby,
LoRAs
,
Sampler
,
ControlNet
,
Upscaler
, ist eine Verfeinerung dieser einen Schleife: beschreiben, erzeugen, anschauen, anpassen.
Das Modell ist der wichtigste Teil. Verschiedene Modelle haben unterschiedliche Stärken:
SDXL
und seine Anime-Feinabstimmungen zeichnen Illustrationen und Charaktere,
Flux
und
Z-Image
folgen langen Prompts und erzeugen lesbaren Text,
Wan
und
LTX
machen Video. ModelTrends.ai zeigt, welche Modelle diese Woche tatsächlich genutzt werden, damit du nicht raten musst. Jede Modellseite zeigt Beispielbilder mit dem genauen Prompt und den Einstellungen, die sie erzeugt haben – das ist der schnellste Weg, um zu lernen.
Du brauchst keinen Gaming-PC zum Start. Das schnellste erste Bild entsteht auf einem Cloud-Dienst, wo die Modelle schon installiert sind: eine Web-App wie
BitVector
, wo du ein Modell auswählst und tippst, oder der PirateDiffusion-Chatbot auf Telegram, wo du einen Befehl schickst. Modelle auf der eigenen Grafikkarte laufen später, wenn du weißt, welche Modelle du magst und ob du Geld für Hardware ausgeben willst.
Referenz
Name | Typ | Bedeutung |
|---|---|---|
Prompt | text | Was du sehen willst. Erst das Motiv, dann die Umgebung, dann Stil und Beleuchtung. Klare Sprache funktioniert bei modernen Modellen; Stichwortlisten bei älteren. |
text | Was du nicht willst (unscharf, extra Finger, Wasserzeichen). Wichtig bei SD 1.5 und SDXL; wird bei Flux und neueren Modellen meist ignoriert. | |
Model / checkpoint | choice | Das Gehirn. Wähle aus der aktuellen Hot-Liste auf dieser Seite; die Modellfamilie bestimmt Aussehen und Prompt-Stil. |
Size | pixels | 512x512 für SD 1.5, 1024x1024 für SDXL und Flux. Andere Formate mit gleicher Pixelzahl funktionieren auch (832x1216 Hochformat, 1216x832 Querformat). |
Steps | number | Wie viele Verfeinerungsdurchgänge. 20 bis 30 sind normal; mehr dauert länger und bringt selten bessere Ergebnisse. |
CFG / guidance | number | Wie streng das Modell dem Prompt folgt. 5 bis 7 bei SDXL, 3.5 bei Flux, 1 bei Turbo- oder Lightning-Modellen. |
Seed | number | Das Start-Rauschen. Derselbe Seed mit denselben Einstellungen erzeugt dasselbe Bild, so kannst du immer nur eine Sache ändern. |
choice | Die Mathematik, die das Rauschen entfernt. Euler oder DPM++ 2M Karras sind sichere Standardwerte; auf der Modellseite steht, was die Beispiele genutzt haben. |
AD

Mach dein erstes Bild ohne Installation
BitVector Prism ist eine Web-App: Wähle eines der Modelle von dieser Seite, tippe den Prompt aus dem Beispiel oben ein und generiere. Nichts herunterladen, nichts einstellen, funktioniert auch auf dem Handy.
Schritt für Schritt
- Öffne den Modellbrowser auf dieser Seite und sortiere nach Hot. Wähle ein Basismodell (Checkpoint, kein LoRA) aus der SDXL- oder Flux-Familie; SDXL-Feinabstimmungen wie DreamShaper XL oder Juggernaut XL sind für den ersten Versuch gut geeignet.
- Lies die Modellseite: Schau dir drei oder vier Beispielbilder und ihre Prompts an. Achte auf das Muster: Motiv, Szene, Beleuchtung, Kamera, Stilwörter.
- Drücke den Run-Button auf der Modellseite. BitVector öffnet eine Web-App mit vorausgewähltem Modell;PirateDiffusionöffnet einen Telegram-Chat, wo du /render gefolgt von deinem Prompt eingibst.
- Schreibe einen ersten Prompt, indem du ein Beispiel kopierst und nur das Motiv änderst. Behalte Größe, Schritte und Sampler aus dem Beispiel bei.
- Erzeuge vier Bilder, nicht nur eins. Zufälliges Rauschen bedeutet, manche Seeds sind besser als andere; ein Modell nur an einem Bild zu beurteilen ist ein Fehler.
- Ändere eine Sache: Füge ein Beleuchtungswort hinzu (goldene Stunde, weiches Studiolicht) oder ein Kamerawort (35mm, Nahaufnahme) und generiere erneut. So lernt man das Prompten.
- Markiere die Modelle, die dir gefallen, mit dem Herz auf der Karte; die Favoriten-Seite speichert sie im Browser, so kannst du ohne Konto zurückkommen.
- Wenn du lokal starten willst, lies den VRAM-Guide und den ComfyUI-Anfänger-Guide auf dieser Seite; dieselben Prompts und Modelle funktionieren dort.
Beispiele
Ein erster Prompt für ein SDXL-Fotomodell
a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo, shallow depth of field
Negative: blurry, deformed hands, watermark, text | 1216x832 | DPM++ 2M Karras | 28 steps | CFG 6
Die gleiche Idee bei PirateDiffusion (Telegram)
/render <dreamshaper-xl> a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo [[blurry, watermark]] /size:1216x832 /steps:28
Ein Flux-Prompt (kein Negativ, geringere Guidance)
A candid photo of a fisherman mending a fishing net on a weathered pier at dawn. Soft fog over the water, warm low sun from the left, shallow depth of field, 35mm film look.
1216x832 | Euler | 24 steps | guidance 3.5
Tipps
- Das Modell ist der wichtigste Hebel, der Prompt der zweite, die Einstellungen der dritte. Anfänger verbringen ihre Zeit oft in der falschen Reihenfolge.
- Kurze, konkrete Prompts sind besser als lange, vage. "Ein rotes Fahrrad lehnt an einer weißen Wand, Morgenlicht, 50mm Foto" ist besser als "wunderschön atemberaubend erstaunlich 8k Meisterwerk Fahrrad".
- Hochformat für Personen, Querformat für Szenen. Quadratisch ist selten die beste Form.
- Speichere die Prompts, die dir gefallen, in einer Textdatei. Jede Modellseite zeigt den vollständigen Prompt unter den Beispielen aus genau diesem Grund.
- Anime- und Illustrationsmodelle (Illustrious, Pony, NoobAI) nutzen tag-artige Prompts; Fotomodelle (Flux, Z-Image, SDXL Foto-Feinabstimmungen) nutzen Sätze. Die Familienseite erklärt das.
- Lade nichts herunter, bevor du ein Modell in der Cloud ausprobiert und gemocht hast. Checkpoints sind 2 bis 24 GB groß.
Fehlerbehebung
Alle Bilder sehen gleich aus
Warum es passiert
Der Seed ist festgelegt oder der Prompt ist eine Liste generischer Qualitätswörter.
So behebst du es
Setze den Seed auf zufällig, entferne "masterpiece, 8k, best quality" aus Fotoprompts, beschreibe stattdessen die Szene.
Hände und Gesichter sind falsch
Warum es passiert
Kleine Gesichter und Hände bei niedriger Auflösung oder ein altes SD 1.5-Modell.
So behebst du es
Nutze SDXL oder Flux mit 1024 Pixeln, rahme das Motiv größer ein oder male das Gesicht später nach (siehe Inpainting-Guide).
Das Bild ignoriert die Hälfte des Prompts
Warum es passiert
Zu viele Ideen in einem Prompt oder zu niedriger CFG-Wert.
So behebst du es
Ein Motiv, eine Umgebung, ein Stil pro Prompt. Erhöhe CFG bei SDXL um eins. Flux und
Qwen
folgen langen Prompts viel besser als SD 1.5.
Text im Bild ist Kauderwelsch
Warum es passiert
SD 1.5 und SDXL können nicht richtig schreiben.
So behebst du es
Es dauert Minuten pro Bild auf meinem Laptop
Warum es passiert
Keine dedizierte GPU oder eine Karte mit weniger als 6 GB Speicher.
So behebst du es
Erzeuge in der Cloud (BitVector, PirateDiffusion) und nutze den Laptop nur zum Anschauen der Ergebnisse.
AD

Tausende Modelle im Chatfenster
PirateDiffusion läuft auf Telegram: Schick /render und einen Prompt, das Bild kommt im Chat zurück. Jedes Modell und LoRA auf dieser Seite mit Run-Button ist dort schon installiert, zu einem festen Monatspreis mit unbegrenzter Nutzung.
Fragen
Muss ich bezahlen, um das auszuprobieren?
Mit welchem Modell sollte ein Anfänger starten?
Eine SDXL-Feinabstimmung für Illustrationen oder ein Flux-Dev-Modell für Fotos. Der "Welche Modelle zuerst ausprobieren"-Guide auf dieser Seite listet sie mit Begründungen auf.
Ist ein LoRA ein Modell?
Ein LoRA ist ein Zusatz, der ein Basismodell verändert. Du brauchst zuerst ein Basismodell (Checkpoint); der LoRA kommt oben drauf. Der LoRA-Guide erklärt das.
Kann ich auch Videos machen?
Ja, mit Wan,
LTX-2
und
MiniMax H3
unter anderem, aber Video braucht lokal viel mehr Speicher. Starte in der Cloud; der Video-Einstiegs-Guide behandelt das.
Sind die Bilder meine?
Lizenzen unterscheiden sich je nach Modell; die Modellseite verlinkt zur Lizenz. Die meisten offenen Modelle erlauben private und kommerzielle Nutzung, einige Forschungslizenzen (frühe Flux-Dev-Builds) nicht.
Warum sehen meine Ergebnisse schlechter aus als die Beispiele?
Meist wegen anderer Größe, Sampler oder Schrittzahl. Kopiere zuerst die Beispiel-Einstellungen genau, ändere dann immer nur eine Sache.
Links und Quellen
- Models browser (sort by hot)
- Weekly ranking
- BitVector web app
- PirateDiffusion on Telegram
- SDXL family page
- Flux family page
Modelle in dieser Anleitung
Geschrieben von
Captain
Verwandte Anleitungen
Modelle
Welche KI-Bildmodelle du zuerst ausprobieren solltest und warum: eine sortierte Startliste
Sieben Modelle für die erste Woche, ausgewählt wegen ihrer Nachsicht statt wegen Hype: ein SDXL Foto-Finetune, ein Anime-Finetune, Flux dev, ein schnelles Turbo-Modell, ein Inpainting-Modell, ein Video-Modell und ein Upscaler, jeweils mit Grund, benötigtem Speicher und erwartetem Prompt-Stil.
Von Captain
2025-09-10
Prompting
Grundlagen des Prompt-Schreibens für KI-Bilder: Aufbau, Reihenfolge, Gewichtung und die zwei Prompt-Dialekte
Wie du einen Prompt schreibst, der beim ersten Mal funktioniert: die Reihenfolge Subjekt-Szene-Stil, warum die Wortposition wichtig ist, der Tag-Dialekt der SDXL-Anime-Modelle gegenüber dem Satz-Dialekt von Flux und Qwen, Aufmerksamkeitsgewichte, Längenbegrenzungen für Prompts und eine Checkliste, um einen ignorierten Prompt zu korrigieren.
Von Captain
2025-10-22
Modelle
Wie generative KI-Bildmodelle funktionieren: Diffusion, Latents und Text-Encoder einfach erklärt
Die Mechanik hinter Stable Diffusion, SDXL, Flux und den Videomodellen ohne Mathe: was Rauschen damit zu tun hat, warum Modelle in einem komprimierten latenten Raum arbeiten, was der Text-Encoder und VAE machen, was Schritte und Guidance wirklich verändern und warum Trainingsdaten bestimmen, was ein Modell zeichnen kann.
Von Quartermaster
2025-08-28
Modelle
Was ist ein LoRA und wie benutzt man ihn in ComfyUI, Forge, Automatic1111 und in der Cloud
LoRAs erklärt für Leute, die Ergebnisse wollen, keine Mathematik: was eine LoRA-Datei verändert, warum sie zur Familie des Basismodells passen muss, Trigger-Wörter, Gewichte, mehrere LoRAs stapeln, der Ordner und die Syntax für jede UI und wie man eine LoRA in der Cloud ausprobiert, bevor man etwas herunterlädt.
Von Captain
2026-05-20
Cloud-Dienste
PirateDiffusion: Führe jedes Modell über Telegram aus, keine GPU nötig
Die wichtigsten Befehle im PirateDiffusion Telegram-Bot: /render mit Modell-Triggerwörtern, (( )) und [[ ]] Gewichtung, #recipes, /adetailer, /highdef und /facelift Upscaling, /remix, /inpaint, ComfyUI Workflows mit /wf /run:, und die neuen // Skills, die das Modell für dich auswählen.
Von Captain
2026-10-03
Weitere Anleitungen
Cloud-Dienste
Pauschalpreis vs. Tokens: Warum unbegrenzte Pläne wie Graydient.ai 2026 den besten Wert für KI-Schöpfer bieten
Ein kostenbasierter Vergleich, Stand 8. Oktober 2026, von Pauschalpreisen für unbegrenzte Pläne wie Graydient.ai gegenüber Token- und Kreditpreisen von Midjourney, Leonardo, fal.ai, Replicate, Runway und Kling: Was 1.000 Bilder und 1.000 Videos pro Monat wirklich kosten und warum eine feste Gebühr für unbegrenzte Bilder, Videos, Audio, Grok LLM-Chat und Web-Apps für Schöpfer, die viel ausprobieren, am besten ist.
Von Captain
2026-10-08
Modelle
FLUX.1 Dev: wie man es anweist, beste Einstellungen und kreative Ideen
Ein praktischer Leitfaden zu FLUX.1 Dev von Black Forest Labs: natürlichsprachige Eingaben, Guidance- und Schritt-Einstellungen, LoRA-Stapelung, Textrendering und Ideen für Eingaben, die seine Stärken nutzen.
Von Captain
2026-09-30
Modelle
Stable Diffusion XL 1.0: Prompts, Einstellungen und was es immer noch am besten kann
Wie du das offizielle SDXL 1.0 Basismodell optimal nutzt: native Auflösungen, CFG- und Sampler-Einstellungen, der Refiner, negative Prompts und Ideen für Stile, in denen SDXL immer noch glänzt.
Von Captain
2026-10-01
Modelle
Stable Diffusion 1.5: das klassische Modell, richtig genutzt
Stable Diffusion 1.5 ist immer noch wichtig: die richtige Auflösung, CFG und Sampler, wie du die riesige Bibliothek von LoRAs und Embeddings nutzt und kreative Prompt-Ideen, die zu einem 512-Pixel-Modell passen.
Von Captain
2026-10-02
Modelle
FLUX.2 Dev: das neueste Black Forest Labs Modell prompten
FLUX.2 Dev bringt längere Prompts, besseren Text, stärkeren Realismus und Multi-Referenz-Bearbeitung. Diese Anleitung erklärt den Turbo-Workflow, Guidance- und Auflösungseinstellungen, die Prompt-Struktur und Ideen, die seine neuen Stärken nutzen.
Von Captain
2026-10-03
Modelle
Qwen-Image: lange Prompts, perfekter Text und zweisprachige Poster
Qwen-Image ist das Modell, das du nutzen solltest, wenn die Wörter im Bild wichtig sind. Lerne, wie du lange, beschreibende Prompts schreibst, englischen und chinesischen Text genau darstellst, CFG und Schritte einstellst und layoutlastige kreative Ideen umsetzt.
Von Captain
2026-09-29

Model
Trends
.ai
© ModelTrends.ai
|
© 2026
|
Alle Rechte vorbehalten