讯飞智作克隆自己声音手机端实操完整流程
讯飞智作手机端可30秒录音、1分钟建模、文字秒变本人声线;需安静环境录30秒自然语音,App内完成一键登录、朗读提示、上传音频、试听优化及配音导出。
用讯飞智作在手机上克隆自己的声音,全程不用电脑、不装插件、不注册复杂账号,30秒录音→1分钟建模→文字秒变你的声线配音,适合短视频口播、课程旁白、店铺宣传等真实需求。
准备工作:确保环境与素材合规
找个安静且无回声的房间,用手机自带的录音功能录制一段约30秒的自然说话音频,内容可如“今天天气不错,我打算去公园走走”,语速保持正常,不要照稿念,也别拖音或使用夸张语气。这一步务必使用你本人清晰可辨的原声,
【若使用他人录音、从视频中提取音轨或背景杂音大的片段,均无法通过声纹校验】
打开讯飞智作App并登录
在手机应用商店下载“讯飞智作”最新App(认准开发者:科大讯飞),安装后打开→点击右下角“我的”→选择“登录/注册”→用手机号一键登录即可,无需企业认证或实名绑定高级权限。
注意:首次登录会弹出隐私协议,必须勾选“同意采集语音用于声纹建模”,否则后续克隆功能不可用。

发起声音克隆任务
回到首页→点击底部导航栏“AI配音”→右上角点“+”号→选择“声音复刻”→点击“开始录制”。此时App会自动开启麦克风,按屏幕提示朗读指定文本(约5秒),完成后系统自动跳转至上传页。
上传页支持两种方式:方法一:直接调用你刚录好的30秒本地音频(推荐);方法二:点击“从相册选择”,找到对应音频文件。上传后等待进度条走完,约90秒内生成音色模型。
这一步不能跳过朗读提示文本环节——它是用来对齐基频和语速基准的,只传30秒原声不触发朗读,系统会判定为“无效样本”而拒绝建模。

验证并使用你的克隆音色
模型生成成功后,页面自动进入“音色管理”,你会看到新出现的音色卡片,名称默认为“我的声音_20260818”。点击右侧“试听”按钮,播放系统合成的一句随机文案,确认音色相似度。
若觉得偏闷或偏尖,返回上一级→点击该音色右上角“…”→选择“重新优化”,系统将基于同一段音频二次微调共振峰参数,无需再录音。
验证无误后,回到AI配音主界面→输入你要配音的文案(支持粘贴、语音输入、拍照取字)→在发音人列表中找到并选中“我的声音_20260818”→点击“生成配音”→导出MP3文件到手机相册或直接分享至剪映等剪辑软件。
-
下载
-
- 关于柯南的沙雕网名有哪些
- 角色扮演 | 1
- 网名
-
- 最新中性名字男女通用网名有哪些
- 角色扮演 | 1
- 网名
-
- 关于蓝色说唱的网名有哪些
- 角色扮演 | 1
- 网名
-
- 我好喜欢你是什么梗?
- 角色扮演 |