OpenVoice:几秒钟克隆任何声音,还能控制情绪和口音
MyShell AI 出品,像拥有一个能模仿任何人的配音演员
它是什么
OpenVoice 是 MyShell AI(一家专注 AI 语音的公司)开发的声音克隆工具。所谓「声音克隆」,就是给 AI 一小段某个人的录音,它就能学会这个人的音色,然后用这个声音去读任何新文字。
它的厉害之处在于「快」和「细」:快,是指只需要几秒钟的参考音频就能克隆;细,是指它不光能模仿音色,还能让你单独控制语气、情绪、口音、节奏。打个比方,它就像一个能模仿任何人说话的配音演员,而且你还能指挥他「用开心的语气、带点北京腔」去说。最新的 V2 版本还支持「零样本跨语言克隆」——不需要任何外语录音,就能让克隆的声音说外语。
解决什么问题
OpenVoice 解决的是「想要某个声音,但拿不到大量录音素材」的难题:
- 只有偶像/角色短短几秒的音频片段,也想克隆他的声音
- 克隆了声音,但希望它能表达不同情绪(开心、悲伤、严肃)
- 想让一个中文声音自然地说英文、日文,不用重新录
- 做虚拟形象,需要一个能灵活调整语气口音的专属声音
它特别适合需要「灵活、多变、可控」声音的创作者。
长什么样
OpenVoice 提供网页操作界面(在浏览器里运行,地址通常是 http://localhost:7860)。主要区域有:
- 参考音频上传区:上传你要克隆的那段几秒钟录音
- 文本输入框:填写要让克隆声音朗读的文字
- 风格控制选项:这是它的特色,可以选语气(中性/开心/悲伤)、口音、语速
- 语言选择:选择参考音频和目标文字的语言
- 合成按钮和播放器:生成、试听、下载
怎么安装
OpenVoice 需要一台电脑,建议有 NVIDIA 显卡(没有也能跑,速度慢些)。安装步骤:
- 安装 Python:去
python.org下载 Python 3.10,安装时勾选「Add Python to PATH」 - 下载项目:打开命令行(Windows 按
Win+R输入cmd),输入git clone https://github.com/myshell-ai/OpenVoice.git - 进入文件夹:输入
cd OpenVoice回车 - 安装依赖:输入
pip install -r requirements.txt,等待安装完成 - 下载模型:按项目说明下载 V2 版本的模型权重文件(AI 的「知识包」),放到指定文件夹
- 启动界面:输入
python webui.py(具体命令以项目文档为准),看到「Running on local URL」即成功 - 打开浏览器:访问命令行提示的地址即可使用
怎么用
咱们走一遍「克隆声音 + 控制情绪」的完整流程。
- 准备参考音频:找一段 5-10 秒的清晰人声录音(比如某人说「大家好,很高兴认识你」),保存为
ref.wav - 上传参考音频:在界面里把
ref.wav拖进上传框 - 输入目标文字:在文本框输入新内容,比如「今天的天气真不错,适合出去走走」
- 选择情绪风格:在风格选项里选「开心(happy)」
- 选择语言:参考音频和目标文字都选「中文」
- 点击合成:等几秒,就能听到那个人的声音、用开心的语气说出新内容
- 试试跨语言:把目标文字改成英文「The weather is great today」,语言选英文,同一个声音就能「说」英语了——这就是 V2 的零样本跨语言克隆
- 下载音频:满意后保存文件
小技巧:参考音频越干净(没有背景音乐和杂音),克隆效果越像。
需要 AI 模型吗?
OpenVoice 本身就是 AI 模型,安装时下载的模型权重文件就是它的「大脑」,不需要你额外申请 API Key(调用云端 AI 的密码)。它在你的电脑本地运行,声音数据不会上传,隐私有保障。
如果你想把 OpenVoice 和其他 AI 工具组合,或者想了解市面上还有哪些好用的 AI 模型,可以去模型导航挑一个适合你的 AI 助手 →
费用
免费开源。OpenVoice 采用 MIT 许可(一种非常宽松、对商用友好的开源协议),个人和商业使用都免费,没有次数限制。你的成本主要是电脑硬件。再次提醒:克隆真人声音务必获得本人授权,别用于不当用途。
适合谁
- 虚拟主播/数字人创作者:打造可灵活调情绪、口音的专属声音
- 多语言内容创作者:一个声音轻松说多国语言
- 有声书/广播剧制作人:精细控制角色的语气情绪
- 游戏/动画开发者:低成本制作多样化角色配音
- AI 语音技术爱好者:体验最前沿的可控声音克隆
项目地址
GitHub 地址:https://github.com/myshell-ai/OpenVoice
项目页面有完整的安装文档、V2 模型下载链接和示例代码。3.4 万星的社区很活跃,遇到问题可以去 Issues(提问区)找答案或求助。