Skip to main content
가사 싱크 모델은 두 가지 작업 중 하나를 수행합니다:
  • **정렬(Alignment)**은 사용자가 제공한 가사를 유지하면서 각 단어가 언제 불리는지 찾아냅니다.
  • **전사(Transcription)**는 공연 음원을 듣고 가사를 작성한 뒤, 단어에 타이밍을 맞춥니다.
먼저 어떤 작업이 필요한지 선택하세요. 고품질 전사 모델도 가사 텍스트를 바꿀 수 있지만, 정렬 모델은 텍스트를 그대로 보존하도록 설계되어 있습니다.

빠른 선택

전사 모델

AudioShake

AudioShake는 대부분의 곡에서 가사 감지를 위한 권장 기본값입니다. 앱에서는 이를 Best로 표시하고, 중간 비용 티어로 보여줍니다.

ElevenLabs Scribe

ElevenLabs Scribe는 원본 공연 음원에서 단어 단위 타이밍이 있는 가사를 생성합니다. 앱에서는 품질 점 4개와 낮은 비용 티어로 표시됩니다. Auto-detect와 다양한 언어 힌트를 지원합니다. 가사를 제공하면 Scribe가 이를 사용해 어휘 인식을 개선합니다. 다만 해당 텍스트를 단어별로 그대로 정렬하는 것은 아니므로, 결과 단어와 줄 묶음을 검토하세요. 제공한 텍스트가 변경되면 안 되는 경우에는 정렬 모델을 사용하세요.

MusicAI

MusicAI는 보컬이 선명한 곡을 위한 또 다른 전사 옵션입니다. 앱에서는 품질 점 4개와 높은 비용 티어로 표시됩니다. ElevenLabs Scribe가 선택된 실시간 Lyrics Sync Model 메뉴

정렬 모델

이미 올바른 가사가 있고 Youka가 그 단어들을 타임라인에 배치하길 원한다면 정렬을 사용하세요.
  • AudioShake alignment는 대부분의 곡에서 권장되는 시작점입니다.
  • MusicAI alignment는 선택한 워크플로에서 가능할 경우, 대체 단어 단위 또는 서브워드 단위 타이밍을 제공합니다.

언어 호환성

언어가 확실하지 않다면 Auto-detect를 유지하세요. 자동으로 선택된 모델이 명시적 언어 힌트를 사용할 수 없으면, Youka가 ElevenLabs Scribe 같은 호환 모델로 전환할 수 있습니다. 모델을 명시적으로 선택한 경우, Youka는 해당 선택을 교체하기 전에 확인을 요청합니다.

모델 선택 위치

Create Karaoke Video 또는 Create Lyric Video에서 Advanced Settings를 연 다음 Lyrics Sync Model을 선택하세요. 사용자가 가사를 제공하는지, 오디오에서 전사하는지, 또는 원본 오디오로 가사 비디오를 만드는지에 따라 사용 가능한 목록이 달라집니다. 같은 워크플로는 Youka Online과 새로운 Youka Desktop에서 모두 사용할 수 있습니다.