← 返回博主原创
BiFish original · 2026-07-25

OpenVoice:几秒钟克隆任何声音,还能控制情绪和口音

MyShell AI 出品,像拥有一个能模仿任何人的配音演员

它是什么

OpenVoice 是 MyShell AI(一家专注 AI 语音的公司)开发的声音克隆工具。所谓「声音克隆」,就是给 AI 一小段某个人的录音,它就能学会这个人的音色,然后用这个声音去读任何新文字。

它的厉害之处在于「快」和「细」:快,是指只需要几秒钟的参考音频就能克隆;细,是指它不光能模仿音色,还能让你单独控制语气、情绪、口音、节奏。打个比方,它就像一个能模仿任何人说话的配音演员,而且你还能指挥他「用开心的语气、带点北京腔」去说。最新的 V2 版本还支持「零样本跨语言克隆」——不需要任何外语录音,就能让克隆的声音说外语。

解决什么问题

OpenVoice 解决的是「想要某个声音,但拿不到大量录音素材」的难题:

  • 只有偶像/角色短短几秒的音频片段,也想克隆他的声音
  • 克隆了声音,但希望它能表达不同情绪(开心、悲伤、严肃)
  • 想让一个中文声音自然地说英文、日文,不用重新录
  • 做虚拟形象,需要一个能灵活调整语气口音的专属声音

它特别适合需要「灵活、多变、可控」声音的创作者。

长什么样

OpenVoice 提供网页操作界面(在浏览器里运行,地址通常是 http://localhost:7860)。主要区域有:

  • 参考音频上传区:上传你要克隆的那段几秒钟录音
  • 文本输入框:填写要让克隆声音朗读的文字
  • 风格控制选项:这是它的特色,可以选语气(中性/开心/悲伤)、口音、语速
  • 语言选择:选择参考音频和目标文字的语言
  • 合成按钮和播放器:生成、试听、下载

怎么安装

OpenVoice 需要一台电脑,建议有 NVIDIA 显卡(没有也能跑,速度慢些)。安装步骤:

  1. 安装 Python:去 python.org 下载 Python 3.10,安装时勾选「Add Python to PATH」
  2. 下载项目:打开命令行(Windows 按 Win+R 输入 cmd),输入 git clone https://github.com/myshell-ai/OpenVoice.git
  3. 进入文件夹:输入 cd OpenVoice 回车
  4. 安装依赖:输入 pip install -r requirements.txt,等待安装完成
  5. 下载模型:按项目说明下载 V2 版本的模型权重文件(AI 的「知识包」),放到指定文件夹
  6. 启动界面:输入 python webui.py(具体命令以项目文档为准),看到「Running on local URL」即成功
  7. 打开浏览器:访问命令行提示的地址即可使用

怎么用

咱们走一遍「克隆声音 + 控制情绪」的完整流程。

  1. 准备参考音频:找一段 5-10 秒的清晰人声录音(比如某人说「大家好,很高兴认识你」),保存为 ref.wav
  2. 上传参考音频:在界面里把 ref.wav 拖进上传框
  3. 输入目标文字:在文本框输入新内容,比如「今天的天气真不错,适合出去走走」
  4. 选择情绪风格:在风格选项里选「开心(happy)」
  5. 选择语言:参考音频和目标文字都选「中文」
  6. 点击合成:等几秒,就能听到那个人的声音、用开心的语气说出新内容
  7. 试试跨语言:把目标文字改成英文「The weather is great today」,语言选英文,同一个声音就能「说」英语了——这就是 V2 的零样本跨语言克隆
  8. 下载音频:满意后保存文件

小技巧:参考音频越干净(没有背景音乐和杂音),克隆效果越像。

需要 AI 模型吗?

OpenVoice 本身就是 AI 模型,安装时下载的模型权重文件就是它的「大脑」,不需要你额外申请 API Key(调用云端 AI 的密码)。它在你的电脑本地运行,声音数据不会上传,隐私有保障。

如果你想把 OpenVoice 和其他 AI 工具组合,或者想了解市面上还有哪些好用的 AI 模型,可以去模型导航挑一个适合你的 AI 助手 →

费用

免费开源。OpenVoice 采用 MIT 许可(一种非常宽松、对商用友好的开源协议),个人和商业使用都免费,没有次数限制。你的成本主要是电脑硬件。再次提醒:克隆真人声音务必获得本人授权,别用于不当用途。

适合谁

  • 虚拟主播/数字人创作者:打造可灵活调情绪、口音的专属声音
  • 多语言内容创作者:一个声音轻松说多国语言
  • 有声书/广播剧制作人:精细控制角色的语气情绪
  • 游戏/动画开发者:低成本制作多样化角色配音
  • AI 语音技术爱好者:体验最前沿的可控声音克隆

项目地址

GitHub 地址:https://github.com/myshell-ai/OpenVoice

项目页面有完整的安装文档、V2 模型下载链接和示例代码。3.4 万星的社区很活跃,遇到问题可以去 Issues(提问区)找答案或求助。

本文基于公开来源进行分析,AI 参与资料整理与初稿生成,最终由人工确认选题和发布。涉及产品能力、价格或政策时,请以原始来源的最新信息为准。