选择声音或克隆你自己的声音
概述
当 Sokuji 朗读你的翻译时(我或两者模式,且“仅文本”已关闭),KizunaAI 会使用一个声音。你可以从约 200 个预设声音中选择一个,也可以用一段简短的录音克隆你自己的声音,让对方用你的声音听到翻译。这些都位于设置 → 高级 → 提供商中。截图来自 Sokuji 0.41.1。
1打开语音设置
打开设置,用面板右上角的按钮切换到高级,然后选择提供商标签页。语音设置会显示当前使用的声音,并附有对其音色的简短描述。

2浏览和筛选预设声音
点击该声音即可打开列表。可以按性别、年龄、口音、用途和风格筛选,点击播放按钮试听样本。试听内容是为你实时合成的,费用从你的账户余额中扣除。

3添加你自己的声音
在自定义声音下选择添加声音…。可以用导入声音…导入音频文件,用录制声音…直接录音,或者把文件拖放到对话框中。片段长度必须在 3 秒到 2 分钟之间,大小不超过 35 MB。

Tip
在安静的房间里自然地说话、录得清晰,效果最好。
4试听、确认并克隆
试听片段,勾选我确认我有权使用此声音,然后点击克隆声音。录音会发送给 Kizuna AI,并转交给 Soniox 以生成你的声音。它不会存储在 Kizuna AI 的服务器上,而是保留在本设备上,以便日后重新生成你的声音。

5使用“我的声音”
你克隆的声音会以我的声音出现在自定义声音下。像选择预设声音一样选中它即可;播放按钮用于试听,垃圾桶按钮用于删除。

6更换你的声音
每个账号只有一个自定义声音。要使用新的录音,请先删除我的声音,再添加新的声音:只是重新录音的话,会保留你现有的声音。

7调整语速
在语音合成(TTS)设置下,语速可以让翻译语音变慢或变快,范围为 0.7× 到 1.3×。

提示
- 只有在朗读翻译时才会用到声音。打开“仅文本”时,以及对方那一侧(始终以文字显示),都不需要声音。
- 创建自定义声音和试听声音都需要账户中有余额。
- 会话运行期间设置会被锁定。请先停止会话,再更换声音。
常见问题
为什么会话使用的是内置声音,而不是“我的声音”?
出现这种情况时,Sokuji 会告诉你并说明原因。最常见的原因有:本设备上没有你的录音副本(在设置中重新录制,即可在这台电脑上使用你的声音);所有自定义声音名额暂时都在使用中;或者无法用该片段生成声音(请尝试更清晰的录音)。会话会继续使用内置声音。
我可以克隆别人的声音吗?
只有在对方许可的情况下才可以。克隆之前,你需要确认自己有权使用该声音。
我的声音在所有区域都能用吗?
自定义声音只属于一个区域,每个区域会分别记住自己的声音选择。如果更改了区域,请在新区域重新添加你的声音。
故障排除
仍然无法解决?可以从账号菜单向我们发送反馈,或发送邮件至 support@kizuna.ai。你也可以在 GitHub Discussions 中提问。