Skip to main content
Les modèles de synchronisation des paroles font l’un des deux travaux suivants :
  • Alignement conserve les paroles que vous fournissez et trouve quand chaque mot est chanté.
  • Transcription écoute l’interprétation, écrit les paroles et chronomètre les mots.
Choisissez d’abord le type de tâche. Un modèle de transcription de haute qualité peut malgré tout modifier le texte des paroles, tandis qu’un modèle d’alignement est conçu pour le préserver.

Sélecteur rapide

Modèles de transcription

AudioShake

AudioShake transcrit l’interprétation enregistrée et affiche un palier de coût moyen. Les résultats varient selon l’enregistrement, la langue, les voix et le mix, donc comparez les modèles lorsque le premier résultat nécessite des corrections importantes.

ElevenLabs Scribe

ElevenLabs Scribe crée des paroles synchronisées à partir de l’interprétation d’origine. L’application affiche un palier de coût faible, prend en charge Auto-detect et accepte un large éventail d’indications de langue. Sur certains morceaux, il peut produire un meilleur premier jet qu’AudioShake et nécessiter moins de corrections ; il vaut donc la peine d’être essayé lorsqu’un autre modèle n’est pas à la hauteur. Si vous fournissez des paroles, Scribe les utilise pour améliorer la reconnaissance du vocabulaire. Il n’aligne pas ce texte mot à mot ; passez donc en revue les mots obtenus et le regroupement des lignes. Utilisez un modèle d’alignement lorsque le texte fourni doit rester inchangé.

MusicAI

MusicAI est une autre option de transcription pour les chansons avec des voix claires. L’application affiche quatre points de qualité et un palier de coût élevé. The live Lyrics Sync Model menu with ElevenLabs Scribe selected

Modèles d’alignement

Utilisez l’alignement lorsque vous avez déjà les paroles correctes et que vous souhaitez que Youka place ces mots sur la timeline.
  • AudioShake alignment préserve le texte des paroles fourni tout en le plaçant sur la timeline.
  • MusicAI alignment propose un minutage alternatif au niveau du mot ou du sous-mot lorsqu’il est disponible dans le workflow sélectionné.

Compatibilité linguistique

Gardez Auto-detect lorsque vous n’êtes pas sûr de la langue. Si un modèle sélectionné automatiquement ne peut pas utiliser une indication de langue explicite, Youka peut basculer vers un modèle compatible comme ElevenLabs Scribe. Si vous avez sélectionné un modèle explicitement, Youka demande avant de remplacer ce choix.

Où choisir le modèle

Ouvrez Advanced Settings dans Create Karaoke Video ou Create Lyric Video, puis choisissez Lyrics Sync Model. La liste disponible change selon que vous fournissez des paroles, transcrivez depuis l’audio ou créez une vidéo de paroles avec l’audio d’origine. Le même workflow est disponible dans Youka Online et le nouveau Youka Desktop.