← ZURÜCK ZUM JOURNAL
    TUTORIAL·6 Min. Lesezeit·

    So bekommst du bei jeder Generierung konsistente KI-Fotos von dir

    Erzeuge zehn KI-Fotos von dir und du bekommst zehn leicht verschiedene Gesichter. Hier ist die Prompt- und Workflow-Disziplin, die Gesicht, Statur und Stil über ein ganzes Shooting hinweg fixiert hält.

    Wenn die meisten Menschen zum ersten Mal mehr als eine KI-Generierung aus demselben Gesichtsfoto starten, fällt es ihnen sofort auf: Foto eins sieht aus wie sie, Foto zwei wie ein Cousin, und bei Foto fünf ist die Ähnlichkeit so weit abgedriftet, dass alle Bilder zusammen wie eine Gegenüberstellung verschiedener Personen wirken. Einzeln betrachtet kann jedes Bild großartig aussehen. Nebeneinander ist die Inkonsistenz das Erste, was jeder sieht.

    Das ist kein Makel, den du hinnehmen musst. Es ist eine konkrete, behebbare Lücke in der Art, wie die meisten Menschen prompten — und sie zu schließen ist der Unterschied zwischen einem einmaligen KI-Foto und einer echten Content-Serie.

    Warum die Konsistenz überhaupt bricht

    Aus Sicht des Modells ist jede Generierung ein eigenständiges Ereignis. Solange du nicht bei jedem Durchlauf dieselben Details ausdrücklich neu verankerst, hat das Modell keine Erinnerung an das, was es zuletzt gerendert hat — es interpretiert dein Referenzfoto jedes Mal neu, mit der Zufälligkeit, die der Sampling-Prozess in genau diesem Durchlauf einbringt. Kleine Mehrdeutigkeiten in deinem Prompt werden jedes Mal anders aufgelöst: Kieferbreite, Augenabstand, der genaue Hautton, wie lang das Haar wirkt. Keines davon ist für sich genommen falsch. Sie passen nur nicht zueinander.

    Die Lösung ist keine besondere Einstellung — sondern Prompts, die so präzise sind, dass dem Modell zwischen den Durchläufen weniger Raum zum Improvisieren bleibt.

    Fixiere die Gesichtsbeschreibung, nicht nur das Gesichtsfoto

    Die meisten laden ein Referenzfoto hoch und gehen davon aus, dass das allein Konsistenz garantiert. Es hilft, leistet aber weniger, als du denkst — das Modell füllt mehrdeutige Details weiterhin jedes Mal nach eigenem Ermessen. Die Lösung: Beschreibe das Gesicht im Prompt selbst, jedes Mal, mit denselben Worten:

    *"gleiche Person: kurzer dunkler Bart, markante Kieferlinie, mittelbrauner Hautton, kurzer Fade-Haarschnitt"*

    Verwende genau diesen Baustein in jedem Prompt der Serie wieder. Schreibe ihn zwischen den Generierungen nicht um und "verbessere" ihn nicht — die Konsistenz entsteht gerade durch die Wiederholung, nicht durch eine bessere Formulierung. Behandle ihn wie eine festgesetzte Variable, nicht wie einen Satz, den du bearbeiten darfst.

    Fixiere Statur und Proportionen genauso

    Gesichter bekommen die meiste Aufmerksamkeit, doch eine uneinheitliche Statur fällt in weiteren Einstellungen genauso auf — Schulterbreite, Größe im Verhältnis zu einem Auto oder Türrahmen, die Gesamterscheinung. Wenn deine Serie sowohl Nahaufnahmen als auch Ganzkörperbilder enthält, ergänze den fixierten Baustein um eine Beschreibung der Statur:

    *"athletische Statur, 1,83 m, breite Schultern"*

    Ohne das können ein Nahaufnahmen-Ausschnitt und ein Ganzkörperbild derselben "Person" wie zwei verschiedene Körpertypen wirken — und das zerstört die Illusion schneller als eine leicht abweichende Kieferlinie.

    Ein Referenzfoto, kein wechselnder Satz

    Wenn du eine Serie erzeugst, widerstehe dem Impuls, für jede neue Szene ein anderes Referenzfoto hochzuladen. Andere Winkel, anderes Licht, andere Ausdrücke in deinen Ausgangsfotos geben dem Modell jeweils andere Informationen, und diese Varianz landet im Ergebnis. Wähle ein sauberes, gut ausgeleuchtetes Referenzfoto mit neutralem Ausdruck und verwende es für die gesamte Serie — je mehr deiner Eingaben fix bleiben, desto fixer bleiben deine Ausgaben.

    Wenn du nur vorteilhafte Fotos von verschiedenen Anlässen hast, ist der Ausweg derselbe fixierte Beschreibungsbaustein von oben — er gleicht die Varianz der Referenzfotos aus, weil er dem Modell einen ausdrücklichen Text gibt, auf den es zurückgreifen kann, statt jedes Mal aus einem leicht anderen Winkel zu raten.

    Halte auch die Variablen jenseits des Gesichts fixiert

    Konsistenz betrifft nicht nur das Gesicht. Wenn sich eine Serie wie ein einziges durchgehendes Shooting anfühlen soll — sagen wir fünf Fotos vom selben "Tag" —, fixiere auch Garderobe und Farbgebung:

    *"trägt denselben anthrazitfarbenen Wollmantel, weißes T-Shirt, dieselbe warme Filmkörnung, dieselbe Farbgebung der goldenen Stunde"*

    Variiere nur, was sich zwischen den Aufnahmen ändern soll: die Umgebung, die Pose, den Kamerawinkel. Alles andere bleibt fixiert. Nach demselben Prinzip wirken Luxus-Lifestyle-Prompts wie ein zusammenhängender Satz statt wie eine Ansammlung unverbundener Bilder — die Umgebung trägt die Abwechslung, die Person bleibt verankert.

    Generiere in einem engen Block, nicht über Tage verteilt

    Das betrifft den Arbeitsablauf, nicht das Prompten, ist aber wichtig: Wenn du einen zusammenpassenden Satz aufbaust, führe alle Generierungen in derselben Sitzung durch, direkt hintereinander, mit demselben hochgeladenen Referenzfoto und demselben fixierten Beschreibungstext, den du frisch in jeden Prompt einfügst. Drei Tage später zurückzukommen und die Beschreibung aus dem Gedächtnis neu zu tippen, ist genau die kleine Varianz, die das Abdriften zurückbringt, das du eigentlich beseitigen willst. Kopiere den funktionierenden Baustein, speichere ihn dort, wo du ihn einfügen kannst, und verwende ihn für die gesamte Lebensdauer der Serie wortgleich.

    Was tun, wenn eine Generierung trotzdem abdriftet

    Selbst wenn all das fixiert ist, bekommst du gelegentlich ein Ergebnis im Block, das nicht passt — ein Gesicht, das nah dran ist, aber auf eine Weise danebenliegt, die du nicht recht benennen kannst. Versuche nicht, dich mit Prompt Engineering aus einer einzelnen misslungenen Generierung herauszuarbeiten. Erzeuge sie mit exakt dem Prompt neu, der bei den gelungenen funktioniert hat. Da das Modell bei jedem Durchlauf erneut Zufall einbringt, egal wie eng der Prompt ist, löst ein zweiter Versuch mit demselben fixierten Text die Sache meist, ohne dass du am Rest der Serie etwas ändern musst.

    Wo PROMPTMVSTR ins Spiel kommt

    Die Prompts im Archiv sind mit genau dieser Disziplin der fixierten Beschreibung geschrieben — auch deshalb hält eine Kategorie wie Exotische Autos oder Luxusreisen als Satz zusammen, statt wie zusammenhanglose Einzelstücke zu wirken. Wenn du deine eigene Serie von Grund auf aufbaust, behandelt So erzeugst du Luxus-KI-Fotos, die wirklich echt aussehen die Prompt-Mechanik, auf der diese Technik aufsetzt, und das Virtual Photoshoot übernimmt Upload und Wiederverwendung des Referenzfotos über einen ganzen Block hinweg automatisch, sodass derselbe Gesichts- und Statur-Baustein bei jeder Generierung durchgezogen wird, ohne dass du ihn neu tippst.

    Bereit, es auszuprobieren? Durchstöbere die KI-Prompt-Bibliothek oder starte ein Virtual Photoshoot. Fragen zu Preisen oder Ablauf? Sieh dir die FAQ an.