Chiedi a qualsiasi generatore la stessa persona due volte e ottieni dei fratelli. La coerenza è il problema più duro del cinema generato, e non si risolve con prompt migliori.

Perché deriva

Una descrizione testuale è una rete larga. «Donna, trentenne, capelli scuri» corrisponde a milioni di volti e il modello ne sceglie uno diverso ogni volta. Luce, angolo e stile spingono il risultato ancora più in là.

Leva uno: i riferimenti

Dai al generatore immagini, non aggettivi. La bibbia del personaggio conserva fino a quattro volti di riferimento e li passa a ogni scena. Questo da solo elimina gran parte della deriva.

Leva due: le varianti

Un solo riferimento frontale non aiuta un’inquadratura di profilo. Le varianti di posa, generate una volta dalla bibbia, coprono gli angoli di cui le scene hanno bisogno.

Leva tre: i frame ancora

Approva un frame di storyboard in cui il personaggio è giusto, poi genera il video da quel frame. La clip eredita il volto invece di reinventarlo.

Usa tutte e tre e la deriva diventa l’eccezione che correggi, non la regola contro cui combatti.