- Выравнивание сохраняет предоставленный вами текст и определяет, когда произносится каждое слово.
- Транскрипция слушает исполнение, записывает текст и расставляет тайминги слов.
Быстрый выбор
Модели транскрипции
AudioShake
AudioShake транскрибирует записанное исполнение и отображается как средний по стоимости вариант. Результаты зависят от записи, языка, вокала и сведения, поэтому сравнивайте модели, если первый результат требует существенных исправлений.ElevenLabs Scribe
ElevenLabs Scribe создаёт текст с таймингами на основе исходного исполнения. В приложении он отмечен как вариант с низкой стоимостью, поддерживает Auto-detect и принимает широкий набор языковых подсказок. На некоторых песнях он может дать более удачный первый вариант, чем AudioShake, и потребовать меньше исправлений, поэтому его стоит попробовать, если другая модель не справилась. Если вы предоставляете текст, Scribe использует его, чтобы улучшить распознавание словаря. Он не выполняет выравнивание этого текста слово в слово, поэтому проверьте итоговые слова и группировку строк. Используйте модель выравнивания, когда предоставленный текст должен оставаться неизменным.MusicAI
MusicAI — ещё один вариант транскрипции для песен с чётким вокалом. В приложении он отмечен четырьмя точками качества и высоким уровнем стоимости.
Модели выравнивания
Используйте выравнивание, когда у вас уже есть правильный текст и вы хотите, чтобы Youka разместила эти слова на таймлайне.- AudioShake alignment сохраняет предоставленный текст, размещая его на таймлайне.
- MusicAI alignment предоставляет альтернативный тайминг на уровне слов или субслов когда он доступен в выбранном workflow.
