声音克隆教程:一分钟录音,复刻你的声音
声音克隆完整步骤:怎么录样本、录多长、环境要求、克隆后怎么调稳定度,以及授权红线。附设计音色作为替代方案的样例。
2026年9月5日
声匠团队
听这篇文章
AI 朗读 · 约 2 分钟
克隆的效果九成取决于样本,不取决于按钮。这篇按操作顺序讲:录什么、录多久、怎么验收,以及什么情况下不该克隆而应该设计音色。
第一步:录样本
- 时长:一到三分钟足够,超过五分钟收益很小。
- 内容:用你平时说话的方式读一段自然的文字,别念新闻稿。
- 环境:安静房间,手机离嘴 20 厘米,关掉空调和风扇。
- 禁忌:背景音乐、多人说话、回声大的房间。
第二步:上传并命名
在声音克隆页面上传样本,给音色起一个你自己认得出的名字。克隆完成通常在一分钟内。
第三步:验收
用三段不同类型的文字试:一段陈述、一段带情绪的对白、一段含数字和英文的句子。听三处:像不像你、有没有电流声、长句会不会掉字。
第四步:调参数
- 稳定度过高像机器人,过低会"抽风",从 0.5 起步。
- 相似度拉到 0.8 以上更像本人,但会放大样本里的瑕疵。
- 情绪靠标签,不靠参数,见情绪标签速查表。
什么时候不该克隆
需要的不是"我的声音"而是"一个专业声音"时,直接用设计音色:一句描述就能造出一个不存在的人,不涉及任何授权问题。
音色: 冷艳女王中文10 秒
音色: 英伦绅士管家中文9 秒
授权红线
只能克隆你自己或已书面授权的人的声音。用名人、同事、家人的录音克隆都不行,细则见声音克隆授权指南。