GPT-Bild-2.5-Hinweisführer: Wie man bessere Bildhinweise schreibt
Ein starker GPT Image 2.5-Prompt ist eine lesbare Produktionsspezifikation. Er beschreibt den Zweck des Bildes, was darin vorkommen muss, wie die Szene komponiert sein soll, wie das Erscheinungsbild aussehen soll und was nicht verändert werden darf. Lange Adjektivlisten sind weniger nützlich als sichtbare, testbare Anweisungen.
OpenAIs offizieller Leitfaden empfiehlt, mit dem erwarteten Ergebnis zu beginnen und dann das Subjekt, die Komposition, den Stil und die Einschränkungen zu beschreiben. Für Änderungen trennen Sie die gewünschten Anpassungen von den geschützten Details. Optimieren Sie jeweils einen Aspekt und überprüfen Sie jedes Ergebnis.
Fünfteilige Prompt-Struktur
1. Zweck
Benennen Sie die Liefergegenstände: E-Commerce-Hauptbild, vertikale Anime-Schlüsselbilder, bearbeitete Diagramme oder transparente Freisteller. Eine klare Zweckbestimmung hilft, mehrdeutige Entscheidungen zu vermeiden.
2. Thema
Beschreibe die sichtbare Identität, das Material, die Kleidung, die Pose und die Bewegung. Bevorzuge "ganzer Körper sichtbar, einschließlich der Füße, mit gesenktem Blick auf ein offenes Buch" anstelle von "energiegeladene, selbstbewusste Pose".
3. Zusammensetzung
Geben Sie die Objektivgröße, den Blickwinkel, die relative Position und den Leerraum an. Fotografiebegriffe sind visuelle Hinweise, keine Garantie für eine präzise optische Simulation.
4. Stil und Beleuchtung
Benennung des Mediums und spezifisches Erscheinungsbild: Celluloid-Stil-Animation, redaktionelle Illustration auf unbeschichtetem Papier, realistische Studiofotos. Beschreiben Sie die Richtung, Farbe und Weichheit des Lichts.
5. Einschränkungen
Listen Sie den benötigten Text, die Ausnahmen und die beizubehaltenden Details auf. Die Einschränkungen sollten beobachtbar sein: „Eine Person“, „Tags unverändert“, „Kein zusätzlicher Text“, „Transparenter Hintergrund“.
Beispiele für generierte Eingabeaufforderungen
Verwendung: Originaler übernatürlicher Animationskurzfilm 9:16 Eröffnungs-Keyframe.
Thema: Eine junge Archivarin mit schulterlangem rotbraunem Haar, schwarzer runder Brille und marineblauer Arbeitsjacke. Sie hält einen versiegelten Papierumschlag mit einem roten Wachssiegel in Mondform.
Komposition: Ganzkörper, Füße sichtbar, Untersicht. Die Figur befindet sich im linken Drittel; hinter ihr erstrecken sich endlose Archivregale. Die obere rechte Ecke bleibt als sauberer dunkler Bereich frei, um später eine Überschrift zu platzieren.
Stil: fein handgezeichneter Anime-Hintergrund, zurückhaltende Cel-Shading-Farbgebung, natürliche Proportionen.
Beleuchtung: Eine warme Tischlampe, die das kühle blaue Mondlicht vor dem hohen Fenster widerspiegelt.
Einschränkung: Nur eine Figur. Umschlag und Abzeichen deutlich sichtbar. Keine Texte, Logos, Wasserzeichen, moderne elektronische Geräte oder leuchtende Augen.
Bei Verwendung der API sollten Modell, Größe, Qualität und Hintergrund als API-Parameter festgelegt werden, anstatt sie in der Textbeschreibung zu verstecken.
Bearbeitungshinweisformel
Verwendung: Änderung + geschützte Details + Integrationsanforderungen + Ausschlüsse.
Ersetze nur den Marine-Arbeitsmantel der Figur durch die beige Feldjacke aus Abbildung 2.
Behalte ihre Gesichtszüge, Brille, Frisur, Körperproportionen, Haltung, Handbewegungen, den Umschlag und die exakte Bildkomposition bei.
Die Jacke mit den vorhandenen Mondlicht-, Tischlampenschatten- und Körpergeometrien abgleichen.
Ändere nicht den Hintergrund, den Kamerawinkel, das Siegel oder den Bildstil. Füge keine Texte, Schmuck oder Wasserzeichen hinzu.
Überprüfen Sie die gesamte Ausgabe. Wiederholte Bearbeitungen können Details verändern, die geschützt werden sollten. Geben Sie daher bei jedem Schritt die wichtigsten Ankerpunkte erneut an.
Rollen für Referenzbilder zuweisen
Nummerieren Sie jeden Eingang und definieren Sie dessen Aufgabe:
Bild 1: Referenz für Identität und Pose.
Bild 2: Nur als Kleidungsreferenz.
Abbildung 3: Nur als Referenz für Licht und Farbe.
Behalte die Person und Komposition von Bild 1 bei. Ersetze nur die Kleidung mit Bild 2. Wende die Beziehung zwischen kaltem Fenster und warmer Lampe aus Bild 3 an, ohne dessen Raum oder Gegenstände zu kopieren.
Dies ist klarer als "davon inspiriert", was das Modell selbst entscheiden lässt, welche Details wichtig sind.
Hinweistext präzisieren
Setzen Sie den gewünschten Text in Anführungszeichen und geben Sie Position, Schriftstil und Ausnahmen an:
"Die letzten Akten"
Layout: Kompakte serifenlose Großbuchstaben, breite Buchstabenabstände, weiß.
Position: Im oberen rechten Bereich, linksbündig.
Keine Untertitel, Besetzungsliste, Logos, Wasserzeichen oder zusätzlicher Text.
Prüfe jedes Zeichen. Offizielle Dokumente weisen darauf hin, dass die Textdarstellung weiterhin Probleme aufweisen kann, insbesondere bei kleiner Schriftgröße, dichten Informationen oder der Verwendung mehrerer Schriftarten. Für geschäftskritische Texte plane beim Generieren von Bildern ausreichend Platz ein und füge die endgültige Typografie in deinem Design-Tool hinzu.
Konsistenz der Rolle Hinweis
Erstelle vor der Generierung einer Szene eine Standardreferenz. Definiere einen kleinen Satz von Identitätsankern: Gesichtsform, Frisur, Augenfarbe, Körperproportionen, ikonische Kleidung und ein Requisit. Verwende genehmigte Bilder als Referenz wieder und wiederhole diese Anker.
Füge nicht in jeden Prompt Hintergrundinformationen ein. Nur visuelle Fakten beeinflussen das Bild. Platziere den Szenenzustand – wie Regen, Schlamm, vorübergehende Schäden – nach dem stabilen Identitätsmodul, damit er das Standarddesign nicht ersetzt.
Wählen Sie Sunburst oder Flare
Wenn Geschwindigkeit entscheidend ist, verwenden Sie Flare. Wenn der Workflow hohe Anforderungen an Qualität oder Bearbeitung stellt, verwenden Sie Sunburst. Behalten Sie die Hinweise, Eingaben, Größe und Qualität bei, um einen Vergleich zu ermöglichen.
Wählen Sie nicht sofort die höchste Qualität, um vage Anweisungen auszugleichen. Entscheiden Sie zuerst, ob das Ergebnis aufgrund unklarer Anweisungen oder unzureichender Render-Treue fehlerhaft ist.
Fehlerbehebung nach Fehlertyp
Fehlende Objekte
Beschreibe ihre Position, Beziehung und Sichtbarkeit: „Der zerbrochene Kompass ist in ihrer rechten Hand, ungehindert, der Kamera zugewandt.“ Entferne konkurrierende Objekte.
Falsche Komposition
Reduzieren Sie die Szenenkomplexität. Geben Sie die Position des Hauptmotivs, die Bildgröße und den Leerraum an. Es wird ein einzelnes Kamerakonzept gefordert, nicht mehrere Kamerabewegungen oder -einstellungen.
Identitätsdrift
Verwenden Sie genehmigte Referenzen, wiederholen Sie unveränderliche Ankerpunkte, fordern Sie eine einmalige Änderung an und schützen Sie ausdrücklich Gesicht, Proportionen, Frisur und Pose.
Unerwünschter Text
Die Anforderung lautet: „Keine Texte, Buchstaben, Zahlen, Zeichen, Logos oder Wasserzeichen.“ Überprüfen Sie möglicherweise störende Hintergrundobjekte, die als Logos identifiziert werden könnten.
Bearbeiten verändert alles
Beginne mit "Nur X ändern". Liste die beibehaltenen Identitäten, Geometrien, Layouts, Beleuchtungen und Beschriftungen auf. Wenn ein Bereich pixelgenau erhalten bleiben muss, füge ihn außerhalb des Generierungsschritts zusammen.
Eingabeaufforderung zu lang
Entferne Hintergrundgeschichten und Synonyme. Strukturiere die Anforderungen in getaggte Module. Ein wartbarer Prompt ist einfacher zu debuggen als poetische Absätze voller sich wiederholender Ideen.
Bewusster iterativer Kreislauf
- Verwenden Sie explizite Modelle und Qualität, um eine Baseline zu generieren.
- Vergleichen Sie die Ergebnisse mit der schriftlichen Abnahmeliste.
- Erkennen Sie eine ungültige Kategorie.
- Ändern Sie einen Befehl oder Parameter.
- Die genehmigten Ergebnisse an die nächste Bearbeitungsrunde weiterleiten.
- Hinweise und Einstellungen für akzeptierte Vermögenswerte.
Die Veränderung von fünf Variablen macht das Lernen unmöglich. Enge Iterationen verringern auch die Wahrscheinlichkeit, dass erfolgreiche Details verschwinden.
Von statischen Bildern zur Elser-Animation
Wenn das erwartete Ergebnis eine Animation ist, weisen Sie darauf hin, dass nutzbare Schlüsselbilder generiert werden: klare Konturen, erkennbare Hände, einfacher Vordergrund, stabile Kleidung und ausreichend Bewegungsraum. Verwenden Sie dann urheberrechtlich geschützte Bilder für den Animationsworkflow, z. B. Elser AI, in dem Sie die Schritte Charakter, Storyboard, Video, Audio und Schnitt fortsetzen können.
Sofern nicht die aktuelle Produktoberfläche die native Verfügbarkeit bestätigt, darf nicht behauptet werden, dass GPT Image 2.5 innerhalb von Elser generiert wurde. Bitte beschreiben Sie den Übergabeprozess genau: Dieses statische Bild wurde mit GPT Image 2.5 erstellt oder bearbeitet und anschließend, sofern unterstützt, zur nachgelagerten Produktion in Elser importiert.
Nach Nutzungsszenario kategorisierte Prompt-Vorlagen
Hauptbild des Produkts
DE: Zweck: Hauptbild für den Online-Verkauf von wiederverwendbaren Trinkflaschen aus Stahl.
Thema: Behalte die geometrische Form der Flasche in Abbildung 1, den Verschluss, das matte Salbeigrün-Finish und das Etikett bei.
Komposition: Mittig auf hellem Stein in einer Dreiviertelansicht, mit ausreichend Platz oben, um das Produkt vollständig zu zeigen.
Beleuchtung: Große Softbox oben links, kontrollierbare Kontaktschatten, echte Reflexionen.
Einschränkungen: Keine Änderung der Etiketten, keine Dellen, Tropfen, Hände, Requisiten, Texte oder Wasserzeichen.
Bearbeitungsskizze
Definieren Sie eine kleine Anzahl von beschrifteten Elementen, deren hierarchische Struktur und Lesereihenfolge. Wenn der genaue Textinhalt umfangreich ist, können Sie zuerst die visuelle Struktur generieren und dann das endgültige Layout außerhalb des Modells hinzufügen. Ein optisch ansprechendes, aber inhaltlich vages Diagramm ist kein Erfolg.
Transparente Vermögenswerte
Promptwort: Ein isoliertes, zentriertes Motiv mit klaren Kanten, ohne Schatten oder Hintergrund. In der API gleichzeitig transparenten Hintergrund und PNG/WebP-Format einstellen. Die tatsächlichen Alphakanaldaten überprüfen.
Filmreife Umgebung
Geben Sie Ort, Zeit, Wetter, Maßstab, Vordergrund/Mittelgrund/Hintergrund sowie den narrativen Fokus an. Ersetzen Sie vage „epische“ Sprache durch räumliche Beziehungen.
Erstellen Sie eine Abnahmeliste vor der Eingabeaufforderung
Bevor der Vorgang beginnt, schreibe fünf bis zehn Bestehen/Nicht-Bestehen-Kriterien auf. Für Schlüsselbilder von Charakteren könnte dies die korrekte Augenfarbe, einen sichtbaren Kompass, eine Person, keinen Text, eine klare rechte Handhaltung und leeren Titelbereich umfassen. Überprüfe anhand der Liste, anstatt nur nach Gefühl zu beurteilen, ob das Bild gut ist.
Zeichne die akzeptierten Prompts, Modelle, Snapshots, Parameter und Referenzinformationen auf. Dadurch werden erfolgreiche Bilder in wiederverwendbare Rezepte umgewandelt und spätere Abweichungen diagnostizierbar gemacht.
Häufig gestellte Fragen
Erzeugen längere Aufforderungen bessere Bilder?
Erfolgt nicht automatisch. Bitte fügen Sie nützliche, sichtbare Anforderungen hinzu und entfernen Sie widersprüchliche oder irrelevante Details.
Sollten Parameter innerhalb des Prompts platziert werden?
Bei Verwendung der API legen Sie über deren Parameter Modell, Qualität, Größe, Format und Hintergrund fest. Verwenden Sie Aufforderungen, um visuelle Inhalte und Einschränkungen festzulegen.
Wie viele Änderungen sollte eine Bearbeitungsanfrage enthalten?
Bevorzugen Sie eine zusammenhängende Änderung. Kleine Bearbeitungen erleichtern die Fehlerdiagnose, geschützte Details sind leichter zu überprüfen.
Kann GPT Image 2.5 die Charakterkonsistenz perfekt bewahren?
Es kann das Subjekt beibehalten, aber die offizielle Dokumentation räumt weiterhin ein, dass Konsistenzprobleme auftreten können. Bitte verwenden Sie Referenzmaterialien, wiederholen Sie Ankerpunkte und überprüfen Sie jede Ausgabe.
Welches Modell eignet sich am besten für Prompt-Tests?
Flare ist in der Regel die bevorzugte Wahl, wenn Geschwindigkeit im Vordergrund steht. Verwenden Sie Sunburst, wenn praktische Anforderungen an hohe Qualität oder präzise Bearbeitung bestehen.
Fazit
Zuverlässige GPT Image 2.5-Prompts sollten das lieferbare Ergebnis beschreiben, nicht Fantasien. Lege Zweck, Subjekt, Komposition, Erscheinungsbild und Einschränkungen klar fest. Gib bei Bearbeitungen genau an, welche Inhalte geändert und welche beibehalten werden sollen. Weise jeder Referenz eine Rolle zu und iteriere jeweils nur eine Variable.
Das Modell ist zwar wichtig, aber die Klarheit der Anweisungen und die Gründlichkeit der Überprüfung entscheiden darüber, ob ansprechende Generierungsergebnisse zu nutzbaren Produktionsressourcen werden können.




