Audio transkribieren
Mach mit xAI STT v1 aus einer Aufnahme Text – bei Bedarf mit Sprecherzuordnung und Füllwörtern.
Was dieses Video zeigt
In diesem Teil transkribieren wir eine Aufnahme. Wähl xAI STT v1 in der Modellauswahl.
Dieses Modell nimmt keinen Prompt: Das Feld ist gesperrt, und unter Referenz öffnet sich ein Slot Audiodatei.
Lade eine Datei hoch oder wähl im Kontextmenü der Bibliothek Als Referenz verwenden (Use as Reference). So holen wir das Voice-over aus dem ersten Teil.
Ist die Datei drin, erscheint der Preis; er richtet sich nach ihrer Länge.
Die Sprache wird automatisch erkannt, oder du wählst sie selbst aus der Liste.
Mehrere Stimmen? Dann Sprecherkennzeichnung (Speaker labels) an. Für „äh“ und „ähm“ im Text: Füllwörter behalten (Keep filler words).
Klick auf Generieren (Generate). Das Transkript kommt in Sekunden, mit Wortzahl.
Kopieren (Copy) legt es in die Zwischenablage.
Auch das Transkript landet in der Bibliothek.
Kurz gesagt: Für Voice-over schreibst du den Text, für Musik beschreibst du den Stil, fürs Transkript gibst du eine Audiodatei.
Weitere Videos aus „Einen Schritt weiter“
Alle Tutorials
1:43Tutorial 14Bilder bearbeiten
Bearbeite ein Bild per Bearbeitungsmodell: Leg es in den Referenz-Slot, sag, was sich ändern und was bleiben soll, behalte das Seitenverhältnis und kombiniere mehrere Bilder.
1:31Tutorial 15aDein erster Workflow
Bau deine erste Kette im Workflow: Füge Knoten hinzu, wähl Modelle, verbinde ein Bild mit einem Video, prüf den Preis und führ die Kette aus.
1:50Tutorial 15bBatch-Generierung im Workflow
Führ eine Kette mit vielen Eingaben aus – mit Batch, Dice und Stack – und sieh, wie sich jeder dieser Knoten auf den Preis auswirkt.
1:49Tutorial 15cWorkflow-Operatoren
Bring den Text in Form, bevor er den Generator erreicht – mit den Operatoren Merge, Caption, Style und Pose.
1:49Tutorial 15dWorkflow-Läufe steuern
Der Preflight-Check, Teile eines Graphen ausführen, Gruppen, Abbrechen, Workflows speichern und die Panels rechts neben der Arbeitsfläche.
1:24Tutorial 16aKI-Voice-over
Mach in LUVI aus Text gesprochene Sprache: Wähl ein Voice-over-Modell und eine Stimme, stell Stabilität und Sprache ein und generiere.
1:26Tutorial 16bKI-Musik
Erstelle in LUVI mit MiniMax Music 2.6 Hintergrundmusik oder einen kompletten Song mit deinem eigenen Songtext.
2:06Tutorial 17Sprechende Avatare und Lippensynchronisation
Lass ein Porträt aus einem Bild und einer Audiodatei sprechen oder gib einem vorhandenen Video mit Modellen für Lippensynchronisation eine neue Stimme.
1:23Tutorial 18a3D-Modelle generieren
Mach mit Hunyuan 3D oder HI3D aus einem Bild oder einer Beschreibung ein 3D-Modell und sieh, wie zusätzliche Ansichten und Parameter das Ergebnis prägen.
1:17Tutorial 18b3D-Viewer und Download
Sieh dir dein 3D-Modell im Viewer an – mit Objektiven, Beleuchtung, Drahtgitter- und Texturansicht – und lade es anschließend als GLB herunter.