← TORNA AL JOURNAL
    TUTORIAL·6 min di lettura·

    Come ottenere foto IA di te coerenti a ogni generazione

    Genera dieci foto IA di te stesso e otterrai dieci volti leggermente diversi. Ecco la disciplina di prompt e di metodo che tiene fissi volto, corporatura e stile lungo un intero servizio.

    La prima volta che si lancia più di una generazione IA dalla stessa foto del viso, quasi tutti se ne accorgono subito: la foto uno somiglia a te, la foto due somiglia a un cugino e, arrivati alla quinta, la somiglianza è derivata abbastanza da far sembrare l'insieme un confronto tra persone diverse. Prese singolarmente, tutte le immagini possono essere ottime. Affiancate, l'incoerenza è la prima cosa che chiunque nota.

    Non è un difetto da accettare. È una lacuna precisa e correggibile nel modo in cui la maggior parte delle persone scrive i prompt — e correggerla è ciò che separa una foto IA isolata da una vera serie di contenuti.

    Perché la coerenza si rompe

    Dal punto di vista del modello, ogni generazione è un evento indipendente. Se non riancori esplicitamente gli stessi dettagli ogni volta, il modello non ha memoria di ciò che ha prodotto poco prima: reinterpreta la tua foto di riferimento da capo, con la casualità che il processo di campionamento introduce in quella specifica esecuzione. Le piccole ambiguità del prompt vengono risolte in modo diverso ogni volta: larghezza della mascella, distanza tra gli occhi, la tonalità esatta della pelle, quanto appaiono lunghi i capelli. Nessuna di queste è sbagliata di per sé. Semplicemente non coincidono tra loro.

    La soluzione non è un'impostazione speciale, ma scrivere prompt abbastanza precisi da lasciare al modello meno spazio per improvvisare in modo diverso da un'esecuzione all'altra.

    Fissa la descrizione del viso, non solo la foto

    La maggior parte delle persone carica una foto di riferimento e dà per scontato che basti a garantire coerenza. Aiuta, ma lavora molto meno di quanto si pensi: il modello continua comunque a colmare i dettagli ambigui con una propria interpretazione, ogni volta. La soluzione è descrivere il viso nel prompt stesso, ogni volta, con le stesse parole:

    *"stesso soggetto: barba corta e scura, mascella definita, incarnato bruno medio, taglio corto sfumato"*

    Riutilizza esattamente questa formula in ogni prompt della serie. Non riscriverla e non "migliorarla" tra una generazione e l'altra: la coerenza nasce proprio dalla ripetizione, non da una formulazione più elegante. Trattala come una variabile bloccata, non come una frase che ti è concesso modificare.

    Fissa allo stesso modo corporatura e proporzioni

    Al viso va quasi tutta l'attenzione, ma l'incoerenza della corporatura si nota altrettanto nei campi più larghi — larghezza delle spalle, altezza rispetto a un'auto o a una porta, struttura generale. Se la tua serie mette insieme primi piani e figure intere, aggiungi alla formula bloccata anche un descrittore della corporatura:

    *"corporatura atletica, 1,83 m, spalle larghe"*

    Senza questo, un primo piano ritagliato e una figura intera della stessa "persona" possono leggersi come due corporature diverse, e questo rompe l'illusione più in fretta di una mascella leggermente differente.

    Una sola foto di riferimento, non un set a rotazione

    Se stai costruendo una serie, resisti alla tentazione di caricare una foto di riferimento diversa per ogni nuova scena. Angolazioni diverse, luce diversa, espressioni diverse nelle foto di partenza danno al modello informazioni diverse, e quella varianza si presenta nel risultato. Scegli una foto di riferimento pulita, ben illuminata, con espressione neutra, e riutilizzala per tutta la serie: più restano fissi i tuoi input, più restano fissi i tuoi output.

    Se hai solo foto riuscite scattate in occasioni diverse, il rimedio è la stessa formula bloccata di cui sopra: compensa la varianza delle foto di riferimento dando al modello un testo esplicito su cui appoggiarsi, invece di farlo indovinare ogni volta da un'angolazione leggermente diversa.

    Tieni fisse anche le variabili che non riguardano il viso

    La coerenza non riguarda solo il volto. Se una serie deve sembrare un unico servizio continuo — diciamo cinque foto dello stesso "giorno" — fissa anche guardaroba e color grading:

    *"indossa lo stesso cappotto di lana antracite, t-shirt bianca, stessa grana calda da pellicola, stesso color grading dell'ora d'oro"*

    Fai variare solo ciò che deve cambiare tra uno scatto e l'altro: l'ambiente, la posa, l'angolo di ripresa. Tutto il resto resta fisso. È lo stesso principio per cui i prompt lifestyle di lusso si leggono come un insieme coerente invece che come un assortimento di immagini scollegate: è l'ambiente a portare la varietà, mentre il soggetto resta ancorato.

    Genera in un blocco ravvicinato, non spalmato su più giorni

    Questo riguarda il metodo, non il prompt, ma conta: se stai costruendo un set coordinato, esegui tutte le generazioni nella stessa sessione, una dopo l'altra, con lo stesso caricamento di riferimento e lo stesso testo descrittivo bloccato incollato di nuovo in ogni prompt. Tornarci tre giorni dopo e ridigitare la descrizione a memoria è esattamente il tipo di piccola varianza che reintroduce la deriva che stai cercando di eliminare. Copia la formula che funziona, salvala dove puoi incollarla e riusala parola per parola per tutta la vita di quella serie.

    Cosa fare quando una generazione devia comunque

    Anche con tutto questo bloccato, ogni tanto otterrai nel blocco un risultato che non coincide: un volto vicino, ma fuori fuoco in un modo che non riesci bene a definire. Non provare a uscire da una singola generazione sbagliata a colpi di prompt engineering. Rigenerala con lo stesso identico prompt usato per quelle riuscite. Poiché il modello reintroduce casualità a ogni esecuzione, per quanto stretto sia il prompt, un secondo tentativo con lo stesso testo bloccato di solito risolve la cosa senza toccare nient'altro nella serie.

    Dove si inserisce PROMPTMVSTR

    I prompt dell'archivio sono scritti con questa stessa disciplina della descrizione bloccata già integrata: è anche per questo che una categoria come auto esotiche o viaggi di lusso tiene insieme come insieme, invece di sembrare una raccolta di pezzi scollegati. Se stai costruendo la tua serie da zero, Come generare foto IA di lusso che sembrino davvero reali copre la meccanica di prompt su cui questa tecnica si appoggia, e il Virtual Photoshoot gestisce automaticamente il caricamento e il riutilizzo della foto di riferimento su un intero blocco, così lo stesso descrittore di volto e corporatura attraversa ogni generazione senza che tu debba ridigitarlo.

    Pronto a provare? Sfoglia la libreria di prompt IA o avvia un Virtual Photoshoot. Domande sui prezzi o sul funzionamento? Consulta le FAQ.