23.5k Star!OpenVoice:这款AI工具能够精准模仿你的声音并说出任何语言!
来源:互联网
时间:2026-08-12 17:12:32
从一小段音频里复制出某个人的声音,然后让它说出多种语言——这听起来像是科幻片里的桥段,但OpenVoice确确实实地做到了。它不仅能把音色克隆得精准,还能对情感的浓淡、口音的轻重、语速的快慢乃至语调的起伏做精细调节。下面这张图可以让你快速感受它的能力:


准确的音色克隆
OpenVoice的第一项看家本领,就是能从参考音频中精确提取说话人的音色特征,然后把这个特征“移植”到任何一个目标语言的发音上。无论是英语、中文还是其他语种,克隆后的声音都保留了原声的辨识度,不会出现“四不像”的尴尬。

灵活的语音风格控制
更难得的是,你可以在保留音色的前提下,单独控制语音的风格参数——比如让声音听起来更开心或更严肃,带点地方口音或保持标准吐字,甚至可以精细调节停顿的时长和语调的升降。下面的演示展示了情感和口音两个维度的调节效果:

零样本跨语言语音克隆
所谓“零样本”,意味着参考语音所用的语言可以完全不在模型的训练集里。即便你给出一段从未见过的语言(比如某种小语种)的原始音频,OpenVoice也能照常克隆,并生成其他语言的语音。下面的例子特意用“U”标记那些训练时未出现过的语言,效果依然让人印象深刻:

如何使用
如果你是熟悉Linux、Python和PyTorch的开发者,可以按照下面的步骤快速上手。克隆仓库后,执行:
conda create -n openvoice python=3.9
conda activate openvoice
git clone git@github.com:myshell-ai/OpenVoice.git
cd OpenVoice
pip install -e .
无论使用V1还是V2版本,上述安装过程都是一致的。
OpenVoice V1
下载V1检查点并解压到 checkpoints 文件夹(具体下载地址请参考官方文档)。然后可以分别尝试以下三种用法:
- 查看
灵活的语音风格控制:
demo_part1.ipynb,了解如何在克隆声音的基础上自由调节风格。 - 查看
跨语言语音克隆:
demo_part2.ipynb,体验训练集内和训练集外语言的效果。 - 运行
Gradio本地演示:
python -m openvoice_app --share启动一个简约的界面。如果遇到问题,建议优先阅读前面两个notebook以及FAQ。
OpenVoice V2
V2版本在安装步骤上与V1相同,但需要额外安装MeloTTS:
pip install git+https://github.com/myshell-ai/MeloTTS.git
python -m unidic download
下载V2检查点并解压到 checkpoints_v2 文件夹。演示用法请参考 demo_part3.ipynb。V2原生支持英语、西班牙语、法语、中文、日语和韩语六种语言。
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名