Skip to main content
Модели синхронизации текста выполняют одну из двух задач:
  • Выравнивание сохраняет предоставленный вами текст и определяет, когда произносится каждое слово.
  • Транскрипция слушает исполнение, записывает текст и расставляет тайминги слов.
Сначала выберите задачу. Даже высококачественная модель транскрипции может изменять текст, тогда как модель выравнивания создана, чтобы его сохранять.

Быстрый выбор

Модели транскрипции

AudioShake

AudioShake транскрибирует записанное исполнение и отображается как средний по стоимости вариант. Результаты зависят от записи, языка, вокала и сведения, поэтому сравнивайте модели, если первый результат требует существенных исправлений.

ElevenLabs Scribe

ElevenLabs Scribe создаёт текст с таймингами на основе исходного исполнения. В приложении он отмечен как вариант с низкой стоимостью, поддерживает Auto-detect и принимает широкий набор языковых подсказок. На некоторых песнях он может дать более удачный первый вариант, чем AudioShake, и потребовать меньше исправлений, поэтому его стоит попробовать, если другая модель не справилась. Если вы предоставляете текст, Scribe использует его, чтобы улучшить распознавание словаря. Он не выполняет выравнивание этого текста слово в слово, поэтому проверьте итоговые слова и группировку строк. Используйте модель выравнивания, когда предоставленный текст должен оставаться неизменным.

MusicAI

MusicAI — ещё один вариант транскрипции для песен с чётким вокалом. В приложении он отмечен четырьмя точками качества и высоким уровнем стоимости. The live Lyrics Sync Model menu with ElevenLabs Scribe selected

Модели выравнивания

Используйте выравнивание, когда у вас уже есть правильный текст и вы хотите, чтобы Youka разместила эти слова на таймлайне.
  • AudioShake alignment сохраняет предоставленный текст, размещая его на таймлайне.
  • MusicAI alignment предоставляет альтернативный тайминг на уровне слов или субслов когда он доступен в выбранном workflow.

Совместимость языков

Оставьте Auto-detect, если вы не уверены в языке. Если автоматически выбранная модель не поддерживает явную языковую подсказку, Youka может переключиться на совместимую модель, например ElevenLabs Scribe. Если вы явно выбрали модель, Youka спросит перед заменой этого выбора.

Где выбрать модель

Откройте Advanced Settings в Create Karaoke Video или Create Lyric Video, затем выберите Lyrics Sync Model. Список доступных вариантов меняется в зависимости от того, предоставляете ли вы текст, транскрибируете ли из аудио или создаёте lyric video с оригинальным аудио. Тот же workflow доступен в Youka Online и в новом Youka Desktop.