Skip to main content
歌词同步模型主要做两类工作之一:
  • 对齐会保留你提供的歌词,并找到每个词被唱出的时间点。
  • 转写会聆听演唱内容,写出歌词,并为 词语计时。
先选择你需要的工作类型。即使是高质量的转写模型也可能改动歌词文本,而对齐模型的设计目标是尽量保留原文本不变。

快速选择

转写模型

AudioShake

AudioShake 是多数歌曲歌词检测的推荐默认选项。应用将其标记为 Best,并显示为中等成本档位。

ElevenLabs Scribe

ElevenLabs Scribe 会基于原始演唱生成逐词计时的歌词。应用显示四个质量点,并标为低成本档位。它支持 Auto-detect 以及 覆盖范围很广的语言提示。 如果你提供歌词,Scribe 会使用它们来提升词汇识别效果。它不会逐词对齐该文本,因此请检查生成结果中的词语与分行分组。当你提供的文本必须保持不变时,请使用对齐模型。

MusicAI

MusicAI 是另一种适用于人声清晰歌曲的转写选项。应用显示四个质量点,并标为高成本档位。 实时的 Lyrics Sync Model 菜单,已选中 ElevenLabs Scribe

对齐模型

当你已经拥有正确歌词,并希望 Youka 将这些词放到时间轴上时,请使用对齐。
  • AudioShake alignment 是多数歌曲的推荐起点。
  • MusicAI alignment 会在所选工作流可用时,提供替代的逐词或子词级计时。

语言兼容性

当你不确定语言时,保持 Auto-detect。如果自动选择的模型无法使用明确的语言提示,Youka 可能会切换到兼容模型,例如 ElevenLabs Scribe。若你已明确选择了某个模型,Youka 会在替换该选择前进行询问。

在哪里选择模型

Create Karaoke VideoCreate Lyric Video 中打开 Advanced Settings, 然后选择 Lyrics Sync Model。可用列表会根据你是否提供歌词、从音频转写,或使用原始音频创建歌词视频而变化。 Youka Online 和新版 Youka Desktop 中都提供相同的工作流。