Skip to main content
歌词同步模型主要做两类工作之一:
  • 对齐(Alignment) 会保留你提供的歌词,并找出每个词在何时被唱出。
  • 转写(Transcription) 会聆听演唱内容,写出歌词,并为这些 词进行时间标注。
先选择要完成的工作。即使是高质量的转写模型也仍可能改动歌词 文本;而对齐模型则旨在保留原文不变。

快速选择

转写模型

AudioShake

AudioShake 会对录制的演唱进行转写,并显示为中等成本档位。 结果会因录音、语言、人声与混音而异,因此当首次结果需要大量修正时, 建议对比不同模型。

ElevenLabs Scribe

ElevenLabs Scribe 会基于原始演唱生成带时间标注的歌词。应用中 显示为低成本档位,支持 Auto-detect,并接受范围广泛的语言 提示。在某些歌曲上,它可能比 AudioShake 给出更好的初稿并 需要更少的修正,因此当其他模型效果不佳时值得一试。 如果你提供歌词,Scribe 会用它们来提升词汇识别效果。它 不会逐词对齐该文本,因此请检查生成的词语与分行 分组。若必须保持提供的文本完全不变,请使用对齐模型。

MusicAI

MusicAI 是另一种适用于人声清晰歌曲的转写选项。应用中 显示四个质量点与高成本档位。 实时的 Lyrics Sync Model 菜单,已选择 ElevenLabs Scribe

对齐模型

当你已经拥有正确歌词并希望 Youka 将 这些词放到时间轴上时,请使用对齐。
  • AudioShake alignment 会在将歌词放到时间轴上的同时,保留 所提供的歌词文本。
  • MusicAI alignment 在所选工作流可用时,提供替代的逐词或子词级时间标注 。

语言兼容性

当你不确定语言时,请保持 Auto-detect。如果自动选择的模型无法使用明确的语言提示, Youka 可能会切换到兼容模型,例如 ElevenLabs Scribe。如果你是明确选择了某个模型, Youka 会在替换该选择前进行询问。

在哪里选择模型

在 Create Karaoke Video 或 Create Lyric Video 中打开 Advanced Settings, 然后选择 Lyrics Sync Model。可用列表会根据你是提供歌词、 从音频转写,还是使用原始音频创建歌词视频而变化。 Youka Online 和新版 Youka Desktop 中提供相同的工作流。