- Выравнивание использует текст, который вы предоставляете, и определяет, когда поётся каждое слово.
- Транскрипция слушает исполнение, записывает текст и расставляет тайминги слов.
Быстрый выбор
Модели транскрипции
AudioShake
AudioShake — рекомендуемый вариант по умолчанию для распознавания текста в большинстве песен. В приложении он отмечен как Best и показан в среднем ценовом уровне.ElevenLabs Scribe
ElevenLabs Scribe создаёт текст с таймингом по словам на основе исходного исполнения. В приложении показаны четыре точки качества и низкий ценовой уровень. Поддерживает Auto-detect и широкий набор языковых подсказок. Если вы предоставляете текст, Scribe использует его, чтобы улучшить распознавание словаря. Он не выравнивает этот текст слово в слово, поэтому проверьте получившиеся слова и группировку строк. Используйте модель выравнивания, когда предоставленный текст должен оставаться неизменным.MusicAI
MusicAI — ещё один вариант транскрипции для песен с чётким вокалом. В приложении показаны четыре точки качества и высокий ценовой уровень.
Модели выравнивания
Используйте выравнивание, когда у вас уже есть правильный текст и вы хотите, чтобы Youka разместила эти слова на таймлайне.- AudioShake alignment — рекомендуемая отправная точка для большинства песен.
- MusicAI alignment предоставляет альтернативные тайминги на уровне слов или подслов, когда это доступно в выбранном рабочем процессе.
