Transcribir audio
Convierte una grabación en texto con xAI STT v1, con etiquetas de hablante y muletillas cuando las necesites.
Lo que explica este video
En esta parte transcribimos una grabación. Elige xAI STT v1 en el selector de modelos.
Este modelo no usa prompt: el cuadro se desactiva y en Referencia se abre un espacio Archivo de audio (Audio File).
Puedes subir un archivo o, en la biblioteca, hacer clic derecho y elegir Usar como referencia (Use as Reference). Así agregamos la voz en off de la primera parte.
Con el archivo cargado aparece el precio, que depende de su duración.
El idioma se detecta solo, o puedes elegirlo tú de la lista.
¿Varias voces? Activa Etiquetas de hablante (Speaker labels). ¿Quieres conservar “eh” y “mmm”? Activa Conservar muletillas (Keep filler words).
Pulsa Generar (Generate). En segundos, la transcripción y su número de palabras.
Con Copiar (Copy), el texto va al portapapeles.
La transcripción también queda en tu biblioteca.
En resumen: para voz en off, escribe el texto; para música, describe el estilo; para transcribir, sube un audio.
Más videos de Un paso más allá
Todos los tutoriales
1:43Tutorial 14Editar tus imágenes
Edita una imagen con un modelo de edición: ponla en la ranura de referencia, indica qué cambia y qué se queda, conserva la relación de aspecto y combina varias imágenes.
1:31Tutorial 15aTu primer flujo de trabajo
Arma tu primera cadena en Flujo de trabajo: agrega nodos, elige modelos, conecta una imagen a un video, revisa el precio y ejecútala.
1:50Tutorial 15bGeneración por lotes en Flujo de trabajo
Ejecuta una misma cadena con muchas entradas usando Lote, Dado y Pila, y mira cómo afecta cada uno al precio.
1:49Tutorial 15cOperadores de Flujo de trabajo
Da forma al texto antes de que llegue al Generador con los operadores Fusionar, Descripción, Estilo y Pose.
1:49Tutorial 15dAdministrar las ejecuciones
El Chequeo prevuelo, cómo ejecutar solo una parte del grafo, los grupos, la cancelación, el guardado de flujos de trabajo y los paneles a la derecha del lienzo.
1:24Tutorial 16aVoz en off con IA
Convierte texto en voz en LUVI: elige un modelo de voz en off y una voz, ajusta la estabilidad y el idioma, y genera.
1:26Tutorial 16bMúsica con IA
Crea música de fondo, o una canción completa con tu propia letra, en LUVI con MiniMax Music 2.6.
2:06Tutorial 17Avatares parlantes y sincronización labial
Haz que un retrato hable a partir de una imagen y un archivo de audio, o dale una voz nueva a un video existente con modelos de sincronización labial.
1:23Tutorial 18aGenerar modelos 3D
Convierte una imagen o una descripción en un modelo 3D con Hunyuan 3D o HI3D, y descubre cómo influyen en el resultado las vistas adicionales y los parámetros.
1:17Tutorial 18bEl visor 3D y las descargas
Examina tu modelo 3D en el visor con lentes, iluminación, malla de alambre y vista de texturas, y luego descárgalo como GLB.