Skip to main content
가사 싱크 모델은 두 가지 작업 중 하나를 수행합니다:
  • **정렬(Alignment)**은 사용자가 제공한 가사를 유지하면서 각 단어가 언제 불리는지 찾습니다.
  • **전사(Transcription)**는 공연을 듣고 가사를 작성한 뒤 단어의 타이밍을 맞춥니다.
먼저 어떤 작업이 필요한지 선택하세요. 고품질 전사 모델도 가사 텍스트를 변경할 수 있지만, 정렬 모델은 텍스트를 보존하도록 설계되어 있습니다.

빠른 선택

전사 모델

AudioShake

AudioShake는 녹음된 퍼포먼스를 전사하며, 앱에서는 중간 비용 티어로 표시됩니다. 결과는 녹음 상태, 언어, 보컬, 믹스에 따라 달라질 수 있으므로 첫 결과에 대폭적인 수정이 필요하다면 모델을 비교해 보세요.

ElevenLabs Scribe

ElevenLabs Scribe는 원본 퍼포먼스에서 타이밍이 포함된 가사를 생성합니다. 앱에서는 낮은 비용 티어로 표시되며, Auto-detect를 지원하고 폭넓은 언어 힌트를 받을 수 있습니다. 어떤 곡에서는 AudioShake보다 더 나은 1차 결과를 만들어 수정이 더 적을 수 있으므로, 다른 모델이 기대에 못 미칠 때 시도해 볼 가치가 있습니다. 가사를 제공하면 Scribe가 어휘 인식을 개선하는 데 이를 활용합니다. 다만 해당 텍스트를 단어 단위로 그대로 정렬하는 것은 아니므로, 결과 단어와 라인 그룹핑을 검토하세요. 제공한 텍스트가 변경되면 안 된다면 정렬 모델을 사용하세요.

MusicAI

MusicAI는 보컬이 또렷한 곡을 위한 또 다른 전사 옵션입니다. 앱에서는 품질 점 4개와 높은 비용 티어로 표시됩니다. The live Lyrics Sync Model menu with ElevenLabs Scribe selected

정렬 모델

이미 정확한 가사가 있고 Youka가 그 단어들을 타임라인에 배치하도록 하고 싶다면 정렬을 사용하세요.
  • AudioShake alignment는 제공된 가사 텍스트를 그대로 보존하면서 타임라인에 배치합니다.
  • MusicAI alignment는 선택한 워크플로에서 사용 가능할 경우 대체 단어 단위 또는 서브워드 단위 타이밍을 제공합니다.

언어 호환성

언어가 확실하지 않다면 Auto-detect를 유지하세요. 자동으로 선택된 모델이 명시적인 언어 힌트를 사용할 수 없는 경우, Youka는 ElevenLabs Scribe 같은 호환 모델로 전환할 수 있습니다. 모델을 명시적으로 선택했다면, Youka는 그 선택을 바꾸기 전에 확인합니다.

모델을 선택하는 위치

Create Karaoke Video 또는 Create Lyric Video에서 Advanced Settings를 연 다음 Lyrics Sync Model을 선택하세요. 사용자가 가사를 제공하는지, 오디오에서 전사하는지, 또는 원본 오디오로 가사 비디오를 만드는지에 따라 사용 가능한 목록이 달라집니다. 동일한 워크플로는 Youka Online과 새로운 Youka Desktop에서 사용할 수 있습니다.