核心操作流程
VoiceCloner 只保留聚焦声音克隆的完整流程,没有多余无关的AI工具或者冗余功能,总共分三步完成操作:
上传一段30到120秒的单人清晰音频样本,录音里不能有背景音乐、回声或者额外杂音。干净的源素材可以保证生成语音的发音、节奏稳定,准确捕捉音色特征。
一分钟内生成私人音色配置文件,不需要长时间训练任务,也不用做额外配置。生成的音色完全对应你上传的样本,不是从公共音色库里挑选的预设音色。
输入任意支持语言的文本,生成语音后可以直接在浏览器里预览,最后导出为MP3或者WAV格式文件。目前支持的语言包括英语、西班牙语、法语、日语和中文。
试用与账号规则
用户不用注册账号就可以测试声音克隆功能,平台会提供有限的免费点数。还没完成克隆的上传音频样本会在大约1天后从服务器记录里删除,完成克隆之后,原始音频样本会作为已保存音色配置文件的一部分留存。登录账号的用户可以在不同浏览器和设备上存储、管理自己的私人音色配置文件。
定价方案
所有套餐统一使用点数体系,当月没用完的点数可以顺延到下一个计费周期。所有支付都通过Stripe处理,支持银行卡、Apple Pay和Google Pay付款。
入门套餐:首月6.93美元,后续每月9.9美元,随时可以取消订阅。每月包含5万点数,大约对应1到1.5小时的生成音频时长,支持保存5个音色配置文件,每天可使用5次AI音色设计功能,支持高清高保真声音克隆,适合制作短内容配音的独立创作者。
专业套餐:首月17.43美元,后续每月24.9美元,随时可以取消订阅。每月包含15万点数,大约对应3.5到4.5小时的生成音频时长,支持保存20个音色配置文件,每天可使用20次AI音色设计功能,享有生成队列优先权限,附带完整商用授权,适合每周都产出音频内容的活跃创作者。
工作室套餐:首月48.3美元,后续每月69美元,随时可以取消订阅。每月包含45万点数,大约对应10到13小时的生成音频时长,支持保存50个音色配置文件,每天可使用50次AI音色设计功能,享有最高优先级的极速生成队列,配备专属客服,附带完整团队商用授权。
不需要长期订阅的用户也可以选择单独的点数充值包。
使用规则
用户必须确认自己拥有上传音频样本的声音所有权,或者已经拿到说话人的明确书面授权,允许克隆并使用对应声音。平台没有预装任何名人或者公众人物的音色,用户不得在没有正式授权的情况下上传他人录音,也不能把克隆出来的音色用于误导或者诈骗场景。即便是公开的YouTube视频或者播客录音,只要没有拿到内容所有者和说话人的明确许可,也不能用来做声音克隆。
适用场景
VoiceCloner 可以服务于播客制作、视频旁白录制、线上课程产出、多语言音频内容生成等场景,适合需要重复使用特定已授权自定义音色身份的创作者。
评论