La plupart des outils vidéo automatisés n'ont qu'une seule voix qui lit tout. On dirait un livre audio avec des images. Un film a un narrateur et il a des personnages, et ils ne doivent pas dire la même chose. Cet article explique comment nous avons conçu le son d'un film d'histoire : la règle qui sépare les deux couches, la façon dont les voix sont attribuées, la manière dont le texte est budgété par rapport à l'image, et comment le mixage est assemblé.

La règle

Le narrateur porte le temps et le lieu ; les personnages portent l'intention. Le réalisateur écrit les dialogues sous forme de répliques parlées rattachées à un personnage présent à l'écran, et la narration sous forme de courtes transitions entre les événements. Si l'histoire contient une réplique, le narrateur ne la paraphrase pas. Si une scène contient une réplique, sa narration est courte ou absente. La règle vit dans les données du scénario, pas dans une consigne de style : chaque scène a un champ de narration et un champ de réplique facultatif avec son locuteur, et les deux sont vérifiés séparément.

Toutes les scènes n'ont pas besoin des deux. Les plans d'ensemble ne prennent généralement que de la narration ; une confrontation peut se contenter d'une réplique et de silence. Un film où chaque scène a les deux couches ressemble à un documentaire sur lui-même.

L'attribution des voix

Chaque membre de la distribution a un profil de voix : genre, âge et un ton décrit en quelques mots. Le studio compare ce profil aux étiquettes du catalogue de voix et évite de donner la même voix à deux personnages. Le narrateur est à votre choix dans la liste de l'assistant, ou choisi automatiquement par défaut. Il est utile que le narrateur diffère de chaque personnage par le genre ou l'âge, pour que l'oreille sépare les couches sans effort.

Le budget

La narration est écrite pour tenir dans sa scène : environ neuf caractères par seconde. Une scène de 10 secondes reçoit au plus quatre-vingt-dix caractères, soit une phrase claire. Les répliques sont limitées à 120 caractères ; les discours plus longs sont répartis sur plusieurs scènes. Nous budgétons en caractères et non en mots, parce que le modèle vocal règle son débit sur les caractères, et que la longueur des mots varie d'une langue à l'autre bien plus que le nombre de caractères. Quand une histoire est plus longue que la cible, le réalisateur supprime des événements, il ne comprime jamais les phrases ; accélérer la parole pour la faire tenir est le moyen le plus rapide de rendre un film incompréhensible.

Le mixage

Les clips de narration sont placés au début de leur propre scène, pas mis bout à bout dans un long fichier unique. Un fichier unique se décale par rapport aux coupes dès qu'un clip dure une fraction de seconde de trop, et à la scène vingt, le narrateur décrit la scène précédente. Le placement scène par scène permet aussi de régénérer une seule scène : on remplace le clip et sa narration ensemble.

La musique est générée une seule fois à partir de la note d'intention du réalisateur et reste à un niveau fixe plus bas sous l'ensemble, en s'abaissant d'une valeur fixe sous la narration et les dialogues plutôt que d'être mixée à l'oreille. Les dialogues sont synchronisés sur les lèvres dans le clip ; quand la synchronisation labiale n'est pas disponible, la réplique est quand même doublée dans la piste pour qu'aucun mot ne soit perdu, et la tâche de synchronisation labiale échouée est remboursée.

Ce qu'il faut écrire pour obtenir le meilleur résultat

  • Écrivez les dialogues entre guillemets, avec le nom du personnage qui parle à proximité.
  • Gardez la narration au passé et laissez-la porter le temps et le lieu.
  • Faites porter une seule idée à chaque scène. Un paragraphe avec deux répliques devient deux scènes.
  • Évitez les chiffres et les abréviations dans la narration ; les modèles vocaux les lisent de façon inégale. Écrivez-les en toutes lettres.
  • Présentez chaque personnage une fois par son nom, avec un détail visuel, pour que le modèle ait déjà vu le nom avant de devoir le prononcer.

Les pièges que nous avons rencontrés

La voix la plus agréable du catalogue a tendance à être la meilleure à la fois pour le narrateur et pour le protagoniste, donc le studio évite cette collision. C'est dans une longue narration qu'une voix faible se remarque le plus ; si une langue est mal couverte par le catalogue, gardez les répliques des personnages courtes et laissez le narrateur en faire moins. Enfin, une narration qui contient une citation est presque toujours une réplique paraphrasée ; le réalisateur a pour consigne de ne pas en écrire, et mieux vaut ne pas en écrire dans l'histoire non plus.

Changer une voix après coup

Pour le narrateur : choisissez n'importe quelle voix dans l'assistant avant de créer le film. Pour la réplique d'un personnage : ouvrez la carte de scène, modifiez le texte ou choisissez une autre voix, puis régénérez cette scène. Seule cette scène est facturée à nouveau.

Questions fréquentes

Le narrateur peut-il être un personnage ? Oui, dans les histoires à la première personne. La voix du narrateur est alors celle de ce personnage, et la règle des deux couches s'applique toujours : la narration décrit, les répliques agissent.

Pourquoi n'y a-t-il qu'une seule réplique parlée par scène ? Parce qu'une scène correspond à un clip et à une synchronisation labiale. Une conversation devient plusieurs courtes scènes, ce qui donne aussi son rythme au film ; le réalisateur divise un paragraphe contenant deux répliques en deux scènes.

Que deviennent les mots si la synchronisation labiale échoue ? Rien n'est perdu. La scène garde son animation, la réplique est doublée avec la voix du personnage dans la piste audio, et la tâche de synchronisation labiale échouée est remboursée dans le portefeuille.