网站介绍
Clone voice是一款带Web界面的AI声音克隆工具,可使用任意人类音色,将文字合成为语音,或将一个声音转换为另一个声音。
该工具操作简单,无需N卡GPU即可使用。下载预编译版本后双击 app.exe 即可打开Web界面,鼠标点点就能用。支持中文、英文、日语、韩语四种语言,并可在线从麦克风录制声音。
为保证合成效果,建议录制时长5秒到20秒,发音清晰准确,不要存在背景噪声。

使用说明
1. 在GitHub项目右侧Releases中下载预编译版,适用于Windows 10/11(已含文字到语音模型,语音到语音模型需单独下载)。Mac用户请拉取源码自行编译。
2. 下载后解压到某处,比如 E:/clone-voice 下
3. 双击 start.bat,等待自动打开Web窗口
4. 输入文字或上传想转换的音频文件,然后录制或从本地上传一段音色文件,开始转换
关于预编译版
- 为减小体积,预编译版仅支持CPU,只包含文字到语音模型
- 如需语音到语音功能(上传音频文件后转换为指定音色的音频),需单独下载语音到语音(speech-to-speech)模型
- 将下载的模型放到和app.exe同级的tts文件夹中,右键“解压到当前文件夹”即可
- 如需GPU支持,请拉取源码本地编译
发表回复