La sincronización labial con IA en Yeşilçam Studios funciona así: en los estilos Cinemation que anima un modelo de vídeo, este anima la boca del personaje que habla, y luego la línea se pronuncia con la voz fija de ese personaje y se alinea palabra por palabra con el movimiento de los labios. El resultado es que cada personaje suena igual en todas las escenas y su boca se mueve cuando dice sus palabras. Esta guía explica el proceso, cómo elegir voces y qué hacer para obtener el mejor resultado.

Dónde se aplica

La sincronización labial se aplica en ocho estilos Cinemation (Wuxiamation, Celmation, Neonmation, Toymation, Toonmation, Claymation, Postermation y Panelmation) cuando hay diálogo, es decir, cuando el selector Habla está en Diálogo o en Ambos. Shadowmation y Pixelmation no los anima un modelo de vídeo sino un motor de animación 2.5D: sus líneas de diálogo se pronuncian igualmente con la voz fija de cada personaje y los subtítulos muestran quién habla, pero no hay animación de la boca ni revisión de clips. En el modo Narrador la voz es externa a la escena y no hay bocas que sincronizar; en Mudo no hay voz. Repase los modos en narrador, diálogo o mudo.

Por qué la voz fija es lo primero

Muchas herramientas de lip sync generan la voz y la boca juntas en cada clip. El problema es que, escena a escena, el mismo personaje puede sonar distinto: más grave, más rápido, con otro acento. En una película de un minuto con seis u ocho escenas, eso rompe la ilusión de inmediato.

Yeşilçam prioriza la coherencia de la voz. Cada personaje tiene asignada una voz fija (la que eligió o la automática) y todas sus líneas se graban con ella. La boca la anima el modelo de vídeo, y después el audio se alinea con ese movimiento. Así, el personaje suena exactamente igual en la primera escena y en la última.

Cómo funciona, paso a paso

  1. El director asigna cada línea a un personaje. Ya sea escrita por usted, por el director o con Escribir diálogo con Sam, cada línea tiene un hablante.
  2. El modelo de vídeo anima la escena. El personaje que habla mueve la boca durante su intervención.
  3. La línea se graba con la voz del personaje. Siempre la misma voz, en todas las escenas.
  4. Se obtienen los tiempos de cada palabra. Un modelo de voz transcribe el audio grabado para saber dónde empieza y dónde termina cada palabra.
  5. La línea completa se ajusta al movimiento de la boca. El audio se estira o se comprime como un todo para encajar con el tramo en que la boca se mueve. No se recorta palabra a palabra, así que los finales de frase no se cortan.

Ese último punto es deliberado. Recortar por palabras puede ajustar mejor algún instante aislado, pero corre el riesgo de comerse la última sílaba o de crear pausas antinaturales. Ajustar la línea entera mantiene la entonación y deja que la frase termine.

Elegir la voz de cada personaje

En la ficha de cada personaje, el campo Voz ofrece Voz: automática o una voz concreta de la lista, con voces de hombre y de mujer. Algunas pautas:

  • Contraste entre personajes. Si dos personajes comparten escena, elija voces claramente distintas. El espectador identifica a quien habla por el oído tanto como por la vista.
  • Coherencia con el aspecto. Un guerrero imponente de Wuxiamation y un osito de Toymation piden voces diferentes. La voz automática elige por usted; una elección manual le da el control total.
  • Series y continuidad. Si va a hacer varios episodios con los mismos personajes, elija las voces a mano y anótelas. Así el personaje suena igual de una película a otra.
  • Narrador aparte. En el modo Ambos, la voz del narrador se elige por separado en el campo Narrador. Procure que no coincida con la de ningún personaje.

Buenas prácticas para una sincronización natural

  • Escriba líneas cortas. Como la línea completa se ajusta al tramo en que se mueve la boca, una frase muy larga para su escena sonará acelerada. Las líneas breves suenan naturales.
  • Un hablante por escena cuando sea posible. La escena se centra en el personaje que habla; alternar muchas voces dentro de un mismo plano complica la lectura.
  • Personajes bien definidos. Una imagen de referencia clara o una descripción concreta ayuda a que el personaje correcto sea el que habla. Vea cómo añadir sus propios personajes.
  • Nombres en las líneas coherentes con las fichas. El hablante de cada línea debe ser uno de sus personajes definidos.
  • Nivel Premium para piezas finales. En calidad Premium, en los ocho estilos con modelo de vídeo, cada clip pasa además por una revisión automática que busca defectos graves, como un personaje equivocado, y regenera solo los clips con problemas importantes, hasta un máximo del 30 % de los clips.

Qué esperar según el estilo

Cada estilo interpreta la boca a su manera. En Celmation y Toonmation el movimiento es el de la animación tradicional, con formas de boca simples y expresivas. En Toymation y Claymation se parece más al de una película de muñecos. En Shadowmation, el teatro de sombras Karagöz, y en Pixelmation no hay boca animada: un motor 2.5D mueve las figuras, y la expresión viene del movimiento del cuerpo, la voz fija y los subtítulos. En Panelmation, además, la revisión automática localiza la cabeza de cada hablante para que los bocadillos del cómic apunten a quien habla.

Si algo no suena bien

Si una línea suena apresurada, acórtela. Si dos personajes se confunden, cambie la voz de uno de ellos o reescriba sus líneas para que tengan registros distintos. Si prefiere controlar cada palabra, use Escribiré el diálogo; lo explicamos en tres maneras de escribir el diálogo. Encontrará ejemplos en la página Animation.

Preguntas frecuentes

¿En qué estilos hay sincronización labial? En ocho estilos Cinemation (Wuxiamation, Celmation, Neonmation, Toymation, Toonmation, Claymation, Postermation y Panelmation), cuando la Habla está en Diálogo o en Ambos. En Shadowmation y Pixelmation el diálogo tiene voz fija y subtítulos, pero no animación de la boca.

¿Mi personaje sonará igual en todas las escenas? Sí. Cada personaje tiene una voz fija y todas sus líneas se graban con ella.

¿Se cortan los finales de las frases? No. La línea completa se ajusta al movimiento de la boca como un todo, sin recortar palabra a palabra.

¿Puedo elegir la voz de cada personaje? Sí. En la ficha del personaje puede dejar Voz: automática o elegir una voz concreta de hombre o de mujer.