Skip to main content
Los modelos de sincronización de letras hacen una de estas dos tareas:
  • Alineación mantiene las letras que proporcionas y encuentra cuándo se canta cada palabra.
  • Transcripción escucha la interpretación, escribe la letra y marca el tiempo de las palabras.
Primero elige la tarea. Un modelo de transcripción de alta calidad aún puede cambiar el texto de la letra, mientras que un modelo de alineación está diseñado para conservarlo.

Selector rápido

Modelos de transcripción

AudioShake

AudioShake transcribe la interpretación grabada y muestra un nivel de costo medio. Los resultados varían según la grabación, el idioma, las voces y la mezcla, así que compara modelos cuando el primer resultado necesite correcciones importantes.

ElevenLabs Scribe

ElevenLabs Scribe crea letras con tiempos a partir de la interpretación original. La app muestra un nivel de costo bajo, admite Auto-detect y acepta una amplia variedad de indicaciones de idioma. En algunas canciones puede ofrecer un mejor primer borrador que AudioShake y dejar menos correcciones, así que vale la pena probarlo cuando otro modelo no da en el clavo. Si proporcionas letras, Scribe las usa para mejorar el reconocimiento del vocabulario. No alinea ese texto palabra por palabra, así que revisa las palabras resultantes y la agrupación por líneas. Usa un modelo de alineación cuando el texto proporcionado deba permanecer sin cambios.

MusicAI

MusicAI es otra opción de transcripción para canciones con voces claras. La app muestra cuatro puntos de calidad y un nivel de costo alto. The live Lyrics Sync Model menu with ElevenLabs Scribe selected

Modelos de alineación

Usa la alineación cuando ya tengas la letra correcta y quieras que Youka coloque esas palabras en la línea de tiempo.
  • AudioShake alignment conserva el texto de la letra proporcionado mientras lo coloca en la línea de tiempo.
  • MusicAI alignment ofrece un timing alternativo a nivel de palabra o de subpalabra cuando esté disponible en el flujo de trabajo seleccionado.

Compatibilidad de idiomas

Mantén Auto-detect cuando no estés seguro del idioma. Si un modelo seleccionado automáticamente no puede usar una indicación explícita de idioma, Youka puede cambiar a un modelo compatible como ElevenLabs Scribe. Si seleccionaste explícitamente un modelo, Youka pregunta antes de reemplazar esa elección.

Dónde elegir el modelo

Abre Advanced Settings en Create Karaoke Video o Create Lyric Video, y luego elige Lyrics Sync Model. La lista disponible cambia según si proporcionas letras, transcribes desde audio o creas un lyric video con el audio original. El mismo flujo de trabajo está disponible en Youka Online y en el nuevo Youka Desktop.