Skip to main content

什么是说话人?

Vozo会根据语音特征自动分配说话人标签(例如,说话人1、说话人2)。这些标签帮助区分每个人的台词,以便进行翻译、配音和语音克隆。 Speakertag Pn

如何检测说话人

Vozo分析音调、音高和时机等语音特征来检测不同的说话人。虽然检测是自动的,但如果需要,您可以手动修正标签。

何时手动修正说话人

在以下情况下更新或调整说话人标签:
  • 一个说话人错误地被拆分为多个标签。
  • 多个说话人被归类为同一标签。
  • 一位说话人在情感上变化很大(例如,平静与愤怒)。对于具有明显情感色彩的台词,创建一个新说话人,以帮助Vozo生成更合适的克隆音色。

如何添加或编辑说话人

1

点击说话人标签

对于您想要修正的片段,点击当前的说话人标签。
2

选择或创建说话人

从下拉菜单中选择正确的说话者,或点击新说话人以添加新的说话人。
3

更新配音

一旦所有修正都完成,点击语音部分右上角的生成语音以应用更改。对于任何新添加的说话人,将会创建一个新的克隆音色。

同声传译

如果多个说话人同时说出相同的台词,您可以将他们分配到一个段落,以便他们的声音一起配音。详情请参见 同声传译

管理说话人的技巧

  • 为说话人重命名以便于区分(例如,“主持人”、“叙述者”、“嘉宾”)。
图片
  • 使用位于语音部分左上方的 筛选器 工具,逐一查看和编辑一个说话人的段落。
说话人筛选器 Pn
  • 使用 更换说话人 下拉菜单右上角的 清除说话人 图标,移除未分配到任何段落的说话人。 图片

常见问题解答

仔细检查说话人标签是否正确。如果一切看起来正常,但音色仍然感觉不对,您可以使用重新克隆音色功能生成更好的结果。
目前,说话人标签是该项目特定的,这意味着每个项目独立检测和分配说话人。
但是,如果您为一个说话人克隆了音色,您可以将其保存到您的库中,并在其他项目中重复使用以保持音频效果的一致性。
最后修改于 2026年6月17日