EchoVox
声音克隆从授权开始,而不是从录音样本开始
干净录音只能证明模型可以学习声音,不能证明说话人同意所有脚本、语言、渠道、受众和未来用途。
无论使用 EchoVox 还是其他制作工具,都应在创建或使用克隆声音前完成这份清单。
确认说话人和请求方身份
确认谁拥有或控制这段声音,以及谁提出克隆请求。公开视频、播客、会议录音、语音留言和社媒内容都不等于自动授权。员工、承包商、演员、客户或家人的声音,应由本人或具有合法权限的代表直接授权。
明确允许的用途
授权应写明项目、脚本类型、语言、渠道、受众、地区和期限。如果实际可能用于付费广告、客户电话、政治内容、成人内容或自动智能体,只写“营销”远远不够。还要说明声音是否可以修改、与其他声音合成或用于训练后续模型。
控制录音和生成内容的访问
限制可以上传参考音频、执行生成、下载文件和共享凭证的人员。保留源录音、授权版本、模型或 Voice ID、脚本、操作者和导出记录。不要把敏感录音放在普通群聊或开放链接文件夹中;成员或供应商不再需要时及时移除权限。
审核并披露合成结果
发布前应由说话人或授权审核者确认代表性结果,尤其是新语言和敏感场景。修正可能改变含义的发音。当受众可能误认为音频是真人实时发言时,应清晰说明使用了合成语音。不得用克隆声音冒充他人、绕过身份验证,或让对方看似认可未经批准的文字。
提前设计撤回与删除流程
授权应说明说话人如何暂停或撤回未来使用,以及参考录音、模型和生成文件如何处理。上线前就要明确联系方式和责任人。已经发布的媒体可能难以完全召回,因此协议要区分未来生成、内部归档和公开副本,并且只保留批准用途和法律义务所需材料。
Production checklist
- 核验说话人或授权代表
- 写明项目、语言、渠道和期限
- 限制录音和 Voice ID 访问
- 保留脚本与导出记录
- 审核新语言和敏感场景
- 明确撤回、保存和删除方式