Bild-Prompts schreiben

Veröffentlicht am:

von:

in:

Bild-Prompts schreiben: 6-Schritte-Struktur für konsistente KI-Bilder

Ihr habt schon 47 Varianten desselben Prompts ausprobiert und das Ergebnis sieht immer noch aus, als hätte die KI eure Beschreibung nur überflogen, während sie gleichzeitig einen anderen Tab mit Katzenvideos offen hatte?

Das Problem ist selten euer Englisch oder die KI. Es ist die Reihenfolge.

Nach gefühlt 1000 generierten Bildern, dutzenden „Prompt-Guides“, die sich alle widersprechen, und mindestens einem Moment, in dem ich ernsthaft überlegt habe, ob die KI mich persönlich nicht mag, bleibt eine Erkenntnis: Bild-Prompts schreiben ist weniger Kunst als vielmehr Handwerk mit einer klaren, wiederholbaren Struktur.

Und ja, diese Struktur existiert wirklich – sie wird nur gerne zwischen „Seid kreativ!“-Ratschlägen versteckt.

Warum müssen wir den Bild-Prompt in richtiger Reihenfolge schreiben?

KI-Bildmodelle lesen eure Prompts nicht wie ein Mensch einen Satz. Sie gewichten. Und zwar stark. Die ersten Begriffe bekommen mehr Aufmerksamkeit als die letzten. Wenn ihr also mit „ein wunderschönes, detailreiches, hochauflösendes, professionelles Foto von…“ beginnt, habt ihr im Prinzip schon die ersten 30 Prozent eures Prompt-Budgets für Adjektive verbrannt, die die KI ohnehin anstrebt, wenn ihr „Foto“ sagt.

OpenAI empfiehlt für seine GPT Image-Modelle explizit die Reihenfolge: Hintergrund und Szene zuerst, dann Subjekt, dann Schlüsseldetails, dann Constraints.

Google nutzt für Nano Banana Pro eine fast identische Logik: Subjekt, Action, Location und Kontext, Komposition, Stil.

Adobe Firefly rät dazu, Stil und Ästhetik upfront zu definieren, dann Komposition, dann Licht, dann Farben und Stimmung.

Der gemeinsame Nenner all dieser Empfehlungen ist nicht zufällig. Modelle funktionieren besser, wenn ihr ihnen zuerst den Kontext gebt, dann das Hauptmotiv, dann die Feinjustierung. Alles andere ist wie wenn ihr einem Fotografen sagt: „Mach es schön!“ und dann erwartet, dass er weiß, ob ihr Hochzeitsfoto oder Produkt-Shooting meint.

Die bewährte Struktur

Hier ist die Reihenfolge, die in der Praxis am robustesten funktioniert – unabhängig davon, welche KI ihr nutzt. Sie ist keine dogmatische Vorschrift, aber ein solides Gerüst, das ihr anpassen könnt, sobald ihr verstanden habt, warum sie funktioniert.

  • 1. Stil oder Medium wählen:
    Foto, Illustration, 3D-Render, Ölgemälde, technische Zeichnung. Das setzt den visuellen Rahmen.
  • 2. Setting oder Szene festlegen:
    Wo spielt das? Studio, Straße, Wald, futuristische Stadt. Gibt dem Subjekt einen Ort.
  • 3. Licht und Atmosphäre definieren:
    Golden Hour, hartes Neonlicht, weiches Fensterlicht, dramatische Schatten. Bestimmt Stimmung und Dimensionalität.
  • 4. Subjekt beschreiben:
    Wer oder was ist im Bild? So spezifisch wie möglich. Nicht ‚Frau‘, sondern ‚Frau in ihren späten 20ern mit kurzen roten Haaren und Sommersprossen‘.
  • 5. Pose oder Ausdruck festlegen:
    Was macht das Subjekt? Blickrichtung, Körperhaltung, Emotion.
  • 6. Details und Constraints definieren:
    Farben, Materialien, Ausschlüsse (’no watermark‘, ’no text‘), Aspect Ratio.

Ein durchstrukturierter Prompt nach diesem Muster könnte so aussehen:

Editorial Fashion Photography, minimalistisches Beton-Studio mit großem bodentiefem Fenster, durch das ein dramatischer Abendhimmel zu sehen ist. Weiches diffuses Fensterlicht fällt von links auf eine Frau in ihren späten 20ern mit natürlicher Hauttextur und entspanntem, nachdenklichem Ausdruck. Sie trägt einen oversized cremefarbenen Zopfpullover mit gerippten Bündchen, steht leicht zur Kamera gedreht, die Hände in den Taschen, den Kopf leicht nach oben geneigt, und blickt sehnsuchtsvoll in den Himmel. Im Himmel ist deutlich eine schlanke Rakete im Aufstieg zu sehen, mit feinen Kondensstreifen, in die sich das warme Abendlicht bricht. Die Stimmung wirkt hoffnungsvoll, von Aufbruch und leiser Abenteuerlust geprägt. Shot on 85mm, shallow depth of field, warme neutrale Farbpalette, sanfte Kontraste, editorial, clean, modern, kein Text, kein Logo.

Vergleicht das mit: „Beautiful woman in sweater looking at rocket in the sky, professional photo, detailed, high quality“.

Auch der Prompt enthält ja bereits das Motiv der Rakete, bleibt aber so allgemein, dass die KI kaum eine konkrete Bildidee erkennt. Beide Prompts wollen vermutlich ein ansprechendes Portrait einer Frau im Pullover erzeugen, die zu einer Rakete am Himmel aufblickt. Nur wird der zweite aussehen wie der Durchschnitt von 10 Millionen anderen „beautiful woman“-Bildern, weil er der KI keine Richtung gibt außer „mach es hübsch“.

Ein flexibles Template für den Alltag

Ihr müsst nicht jedes Mal bei Null anfangen. Baut euch ein wiederverwendbares Gerüst:

[Stil/Medium] von [Subjekt mit spezifischen Merkmalen], [Pose/Action], in [Setting/Umwelt], [Lichtung und Atmosphäre], [Komposition/Kamera], [Farbpalette], [Constraints].

Das ist keine starre Formel. Es ist ein Sicherheitsnetz. Wenn ihr merkt, dass eure Bilder konsistenter werden, könnt ihr anfangen, gezielt davon abzuweichen – aber erst dann.

Delimiter, Gewichtung und andere Kontrollmechanismen

Jetzt wird es technisch. Viele Modelle unterstützen Syntax, mit der ihr bestimmte Teile eures Prompts hervorheben, gruppieren oder ausschließen könnt. Das ist besonders nützlich, wenn ihr komplexe Szenen baut oder unerwünschte Elemente konsequent loswerden wollt.

Delimiter-Typen im Überblick

  • Anführungszeichen („ „): Heben Phrasen als Einheit hervor. Nützlich bei mehrteiligen Konzepten wie „retro futuristisches Auto“.
  • Klammern und Gewichtung (Midjourney): (Wort:1.5) erhöht die Gewichtung, [Wort] verringert sie. Vorsicht: Zu viel Gewichtung macht Bilder instabil.
  • Negative Prompts: „no watermark“, „no text“, „no extra limbs“. Funktioniert modellabhängig. Bei DALL·E und FLUX eher als natürlicher Satz: „ohne Text im Bild“.
  • Parameter am Ende: Aspect Ratio (–ar 16:9), Qualität (–q 2), Stil-Voreinstellungen (–style raw). Immer ans Ende, damit sie nicht mit dem Inhalt konkurrieren.

Ein Beispiel mit Delimitern und Parametern:

"Cinematic science fiction" scene: 
[Subject] "weathered astronaut from the waist up", (positioned on the right half of the frame), slowly turning toward the camera. 
[Environment] "inside a dimly lit space station corridor", (harsh fluorescent overhead light) + (blue and red emergency glow), casting dramatic shadows. 
[Details] "cracked, scratched helmet with condensation and fine dust", [Background element] "old, slightly torn poster on the left wall" with the text ("code78") clearly visible. 
[Camera & Style] "Shot on ARRI Alexa", (35mm anamorphic), (shallow depth of field), (film grain), (high contrast), (moody atmosphere). 
--ar 16:9 --style raw --q 2 --chaos 10

Hier trennen die Anführungszeichen den Stil klar vom Rest. Die Kamera- und Lichtangaben kommen gebündelt. Die Parameter stehen isoliert am Ende. Das ist keine Magie. Es ist Ordnung.

Modell-spezifische Feinheiten: Midjourney, DALL·E, FLUX und Co.

Nicht alle Modelle ticken gleich. Was bei Midjourney funktioniert, kann bei DALL·E 3 zu völlig anderen Ergebnissen führen. Hier eine kurze Orientierung:

  • Midjourney: Reagiert stark auf Stil-Referenzen und künstlerische Begriffe. Gewichtung mit ( ) und [ ] funktioniert gut. Parameter wie –ar, –q, –style raw sind essenziell für Kontrolle.
  • DALL·E 3: Versteht natürliche Sprache besser als Tags. Lange, prosaische Prompts funktionieren hier oft besser als komprimierte Keyword-Listen. Negative Constraints als Satz formulieren.
  • FLUX.2: Stark bei fotorealistischen Szenen. Reagiert gut auf konkrete Licht- und Kamerabeschreibungen. Weniger anfällig für „overprompting“.
  • Ideogram: Exzellent bei Text im Bild. Hier könnt ihr explizit schreiben, welcher Text wo erscheinen soll.

Die Grundstruktur bleibt gleich. Nur die Feinjustierung ändert sich. Wenn ihr merkt, dass ein Modell eure Lichtangaben ignoriert, probiert es bei einem anderen. Manchmal liegt es nicht am Prompt. Es liegt am Werkzeug.

Typische Fehler beim Bild-Prompts schreiben

Nach hunderten Prompts fallen bestimmte Muster auf. Hier sind die Klassiker, die eure Ergebnisse zufällig aussehen lassen – auch wenn ihr euch Mühe gebt.

  • Zu viele Adjektive vor dem Subjekt: „Beautiful, stunning, gorgeous, highly detailed, professional…“ Die KI hört nach dem dritten Adjektiv auf zu unterscheiden. Sagt, was ihr wollt, nicht wie toll es sein soll.
  • Widersprüchliche Stilangaben: „Photorealistic oil painting“ ist kein Stil. Es ist ein Widerspruch.
  • Vage Subjekte: „Person“, „Auto“, „Gebäude“. Die KI füllt die Lücken mit dem Durchschnitt des Internets. Seid spezifisch.
  • Licht und Setting vergessen: Ohne Lichtangabe entscheidet die KI willkürlich. Ohne Setting schwebt euer Subjekt im weißen Nichts.
  • Constraints zu früh: „No text“ in der ersten Zeile wird oft ignoriert. Constraints gehören ans Ende, nach dem Inhalt.
  • Alles auf einmal: Wenn ihr zum ersten Mal mit Bild-Prompts arbeitet, fangt einfach an. Subjekt, Setting, Stil. Dann erweitert ihr. Nicht jeder Prompt muss ein Epos sein.

Und ja, manchmal generiert die KI einfach etwas Seltsames, obwohl ihr alles richtig gemacht habt. Das ist nicht euer Fehler. Das ist, als würdet ihr eine Axt 2000 benutzen, um ein Bild zu malen – das Werkzeug ist nicht für jede Nuance gemacht. Aber mit der richtigen Struktur trefft ihr deutlich öfter, was ihr meint.

Fazit: Eure nächste Prompt-Session wird anders aussehen

Bild-Prompts schreiben ist kein Ratespiel. Es ist Handwerk mit einer klaren, erlernbaren Struktur. Wenn ihr euch an die Reihenfolge Stil → Setting → Licht → Subjekt → Pose → Details haltet, bekommt ihr konsistentere, kontrollierbarere Ergebnisse – unabhängig vom Modell. Die ersten paar Male fühlt es sich vielleicht starr an. Aber sobald ihr verinnerlicht habt, warum diese Reihenfolge funktioniert, werdet ihr merken: Ihr verschwendet weniger Credits, weniger Zeit und weniger Nerven.

Probiert es aus. Nehmt einen eurer alten Prompts, baut ihn nach dieser Struktur um und vergleicht die Ergebnisse. Ich wette, ihr werdet den Unterschied sehen.

Ähnliche Beiträge

Heidi Schönenberg-Hausdorf

Von: Heidi Schönenberg-Hausdorf

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

Heidi Schönenberg-Hausdorf

Hallo

Ich bin Heidi. Offiziell von der IHK gekrönte Software-Hoheit und Social-Media-Maestra. In meiner Wall of Frames hängen Psychologie-­Expertise und frische KI-Zertifikate friedlich nebeneinander. Ich verstehe also Menschen und Maschinen – fragt sich nur, wer von beiden anstrengender ist.

Als Expertin im …

Alle Kategorien

Buy now or cry later

Social Media ist tot – von Heidi Schönenberg-Hausdorf

Von der selbsternannten Bestsellerautorin. Seit dem 15.Oktober 2017 in der Hinterhofkaschemme eures Vertrauens erhältlich.

Easter Egg

B A