- **정렬(Alignment)**은 사용자가 제공한 가사를 유지하면서 각 단어가 언제 불리는지 찾아냅니다.
- **전사(Transcription)**는 공연 음원을 듣고 가사를 작성한 뒤, 단어에 타이밍을 맞춥니다.
빠른 선택
전사 모델
AudioShake
AudioShake는 대부분의 곡에서 가사 감지를 위한 권장 기본값입니다. 앱에서는 이를 Best로 표시하고, 중간 비용 티어로 보여줍니다.ElevenLabs Scribe
ElevenLabs Scribe는 원본 공연 음원에서 단어 단위 타이밍이 있는 가사를 생성합니다. 앱에서는 품질 점 4개와 낮은 비용 티어로 표시됩니다. Auto-detect와 다양한 언어 힌트를 지원합니다. 가사를 제공하면 Scribe가 이를 사용해 어휘 인식을 개선합니다. 다만 해당 텍스트를 단어별로 그대로 정렬하는 것은 아니므로, 결과 단어와 줄 묶음을 검토하세요. 제공한 텍스트가 변경되면 안 되는 경우에는 정렬 모델을 사용하세요.MusicAI
MusicAI는 보컬이 선명한 곡을 위한 또 다른 전사 옵션입니다. 앱에서는 품질 점 4개와 높은 비용 티어로 표시됩니다.
정렬 모델
이미 올바른 가사가 있고 Youka가 그 단어들을 타임라인에 배치하길 원한다면 정렬을 사용하세요.- AudioShake alignment는 대부분의 곡에서 권장되는 시작점입니다.
- MusicAI alignment는 선택한 워크플로에서 가능할 경우, 대체 단어 단위 또는 서브워드 단위 타이밍을 제공합니다.
