Skip to main content
Lyrics-Sync-Modelle erledigen eine von zwei Aufgaben:
  • Ausrichtung übernimmt die von Ihnen bereitgestellten Lyrics und ermittelt, wann jedes Wort gesungen wird.
  • Transkription hört sich die Performance an, schreibt die Lyrics und timt die Wörter.
Wählen Sie zuerst die Aufgabe. Ein hochwertiges Transkriptionsmodell kann den Lyrics-Text dennoch verändern, während ein Ausrichtungsmodell darauf ausgelegt ist, ihn zu bewahren.

Schnellauswahl

Transkriptionsmodelle

AudioShake

AudioShake transkribiert die aufgenommene Performance und zeigt eine mittlere Kostenstufe an. Die Ergebnisse variieren je nach Aufnahme, Sprache, Vocals und Mix – vergleichen Sie daher Modelle, wenn das erste Ergebnis erhebliche Korrekturen erfordert.

ElevenLabs Scribe

ElevenLabs Scribe erstellt getimte Lyrics aus der Original-Performance. Die App zeigt eine niedrige Kostenstufe an, unterstützt Auto-detect und akzeptiert eine breite Auswahl an Sprachhinweisen. Bei einigen Songs kann es einen besseren ersten Durchgang als AudioShake liefern und weniger Korrekturen hinterlassen – daher lohnt es sich, es auszuprobieren, wenn ein anderes Modell danebenliegt. Wenn Sie Lyrics bereitstellen, verwendet Scribe sie, um die Wortschatzerkennung zu verbessern. Es richtet diesen Text nicht Wort für Wort aus, daher sollten Sie die resultierenden Wörter und die Zeilengruppierung überprüfen. Verwenden Sie ein Ausrichtungsmodell, wenn der bereitgestellte Text unverändert bleiben muss.

MusicAI

MusicAI ist eine weitere Transkriptionsoption für Songs mit klaren Vocals. Die App zeigt vier Qualitäts-Punkte und eine hohe Kostenstufe an. The live Lyrics Sync Model menu with ElevenLabs Scribe selected

Ausrichtungsmodelle

Verwenden Sie Ausrichtung, wenn Sie bereits die korrekten Lyrics haben und möchten, dass Youka diese Wörter auf der Timeline platziert.
  • AudioShake alignment bewahrt den bereitgestellten Lyrics-Text, während es ihn auf der Timeline platziert.
  • MusicAI alignment bietet alternative Timing-Optionen auf Wort- oder Subword-Ebene, sofern im ausgewählten Workflow verfügbar.

Sprachkompatibilität

Lassen Sie Auto-detect aktiviert, wenn Sie sich bei der Sprache nicht sicher sind. Wenn ein automatisch ausgewähltes Modell keinen expliziten Sprachhinweis verwenden kann, kann Youka zu einem kompatiblen Modell wie ElevenLabs Scribe wechseln. Wenn Sie ausdrücklich ein Modell ausgewählt haben, fragt Youka nach, bevor es diese Auswahl ersetzt.

Wo Sie das Modell auswählen

Öffnen Sie Advanced Settings bei Create Karaoke Video oder Create Lyric Video, und wählen Sie dann Lyrics Sync Model. Die verfügbare Liste ändert sich je nachdem, ob Sie Lyrics bereitstellen, aus Audio transkribieren oder ein Lyric-Video mit dem Original-Audio erstellen. Der gleiche Workflow ist in Youka Online und im neuen Youka Desktop verfügbar.