首页 > 教程攻略 > ai资讯 >23.5k Star!OpenVoice:这款AI工具能够精准模仿你的声音并说出任何语言!

23.5k Star!OpenVoice:这款AI工具能够精准模仿你的声音并说出任何语言!

来源:互联网 时间:2026-08-12 17:12:32

从一小段音频里复制出某个人的声音,然后让它说出多种语言——这听起来像是科幻片里的桥段,但OpenVoice确确实实地做到了。它不仅能把音色克隆得精准,还能对情感的浓淡、口音的轻重、语速的快慢乃至语调的起伏做精细调节。下面这张图可以让你快速感受它的能力:

准确的音色克隆

OpenVoice的第一项看家本领,就是能从参考音频中精确提取说话人的音色特征,然后把这个特征“移植”到任何一个目标语言的发音上。无论是英语、中文还是其他语种,克隆后的声音都保留了原声的辨识度,不会出现“四不像”的尴尬。

灵活的语音风格控制

更难得的是,你可以在保留音色的前提下,单独控制语音的风格参数——比如让声音听起来更开心或更严肃,带点地方口音或保持标准吐字,甚至可以精细调节停顿的时长和语调的升降。下面的演示展示了情感和口音两个维度的调节效果:

零样本跨语言语音克隆

所谓“零样本”,意味着参考语音所用的语言可以完全不在模型的训练集里。即便你给出一段从未见过的语言(比如某种小语种)的原始音频,OpenVoice也能照常克隆,并生成其他语言的语音。下面的例子特意用“U”标记那些训练时未出现过的语言,效果依然让人印象深刻:

如何使用

如果你是熟悉Linux、Python和PyTorch的开发者,可以按照下面的步骤快速上手。克隆仓库后,执行:

conda create -n openvoice python=3.9
conda activate openvoice
git clone git@github.com:myshell-ai/OpenVoice.git
cd OpenVoice
pip install -e .

无论使用V1还是V2版本,上述安装过程都是一致的。

OpenVoice V1

下载V1检查点并解压到 checkpoints 文件夹(具体下载地址请参考官方文档)。然后可以分别尝试以下三种用法:

  • 灵活的语音风格控制:

    查看 demo_part1.ipynb,了解如何在克隆声音的基础上自由调节风格。
  • 跨语言语音克隆:

    查看 demo_part2.ipynb,体验训练集内和训练集外语言的效果。
  • Gradio本地演示:

    运行 python -m openvoice_app --share 启动一个简约的界面。如果遇到问题,建议优先阅读前面两个notebook以及FAQ。

OpenVoice V2

V2版本在安装步骤上与V1相同,但需要额外安装MeloTTS:

pip install git+https://github.com/myshell-ai/MeloTTS.git
python -m unidic download

下载V2检查点并解压到 checkpoints_v2 文件夹。演示用法请参考 demo_part3.ipynb。V2原生支持英语、西班牙语、法语、中文、日语和韩语六种语言。