Avatares parlantes y sincronización labial
Haz que un retrato hable a partir de una imagen y un archivo de audio, o dale una voz nueva a un video existente con modelos de sincronización labial.
Lo que explica este video
En LUVI puedes hacer hablar a un retrato o dar voz nueva a un video. Ambas tareas las hacen los modelos de sincronización labial.
Busca “lipsync” en la lista de modelos. Los que reciben una imagen y un audio crean un avatar parlante; los que reciben un video ajustan sus labios a una voz nueva.
Empecemos con un avatar parlante. Aquí usamos OmniHuman 1.5.
En Referencia se abren dos espacios: uno para la imagen y otro para el audio. Ambos son obligatorios.
Para la imagen, usa un retrato con la cara bien visible. En la biblioteca, dale clic derecho y elige Usar como referencia (Use as Reference).
¿Aún no tienes audio? Puedes crearlo en LUVI con un modelo de texto a voz; así hicimos esta frase. El audio entra en su espacio de la misma forma.
El video dura lo mismo que el audio, y OmniHuman acepta hasta 60 segundos. El precio se calcula por segundo de audio y aparece cuando ambos espacios están llenos.
En el prompt, describe la emoción, el ritmo y la forma de hablar. Pedimos un tono cálido, una sonrisa y la mirada a cámara.
Pulsa Generar (Generate). El resultado llega a tu biblioteca como un video que habla con el audio que le diste.
Ahora demos una voz nueva al mismo video, por ejemplo en turco. Para eso elegimos Sync Lipsync; VEED Lipsync es una opción más barata.
Aquí los espacios son un video y un archivo de audio, y no hay prompt. Coloca el video y el audio nuevo; cada uno puede durar hasta 60 segundos.
Aquí también el precio va por segundos de audio. Pulsa Generar y los labios se vuelven a sincronizar con el audio nuevo.
En resumen: imagen y audio para un avatar parlante, video y audio para una voz nueva, y el precio depende de la duración del audio.
Más videos de Un paso más allá
Todos los tutoriales
1:43Tutorial 14Editar tus imágenes
Edita una imagen con un modelo de edición: ponla en la ranura de referencia, indica qué cambia y qué se queda, conserva la relación de aspecto y combina varias imágenes.
1:31Tutorial 15aTu primer flujo de trabajo
Arma tu primera cadena en Flujo de trabajo: agrega nodos, elige modelos, conecta una imagen a un video, revisa el precio y ejecútala.
1:50Tutorial 15bGeneración por lotes en Flujo de trabajo
Ejecuta una misma cadena con muchas entradas usando Lote, Dado y Pila, y mira cómo afecta cada uno al precio.
1:49Tutorial 15cOperadores de Flujo de trabajo
Da forma al texto antes de que llegue al Generador con los operadores Fusionar, Descripción, Estilo y Pose.
1:49Tutorial 15dAdministrar las ejecuciones
El Chequeo prevuelo, cómo ejecutar solo una parte del grafo, los grupos, la cancelación, el guardado de flujos de trabajo y los paneles a la derecha del lienzo.
1:24Tutorial 16aVoz en off con IA
Convierte texto en voz en LUVI: elige un modelo de voz en off y una voz, ajusta la estabilidad y el idioma, y genera.
1:26Tutorial 16bMúsica con IA
Crea música de fondo, o una canción completa con tu propia letra, en LUVI con MiniMax Music 2.6.
1:06Tutorial 16cTranscribir audio
Convierte una grabación en texto con xAI STT v1, con etiquetas de hablante y muletillas cuando las necesites.
1:23Tutorial 18aGenerar modelos 3D
Convierte una imagen o una descripción en un modelo 3D con Hunyuan 3D o HI3D, y descubre cómo influyen en el resultado las vistas adicionales y los parámetros.
1:17Tutorial 18bEl visor 3D y las descargas
Examina tu modelo 3D en el visor con lentes, iluminación, malla de alambre y vista de texturas, y luego descárgalo como GLB.