
适用场景
按真实工作流选择能力,不把AI描述成无需确认的黑盒。
团队希望保存常用音色,并用统一声音风格生产配音。
用户有清晰单人参考音频,希望建立本地克隆音色生成配音。
核心能力
AI分析、人工确认与智能组装共同完成。
文本转配音
输入文案、选择音色和语速,生成后可试听结果并打开输出目录。
音色来源切换
语音合成支持本地音色、无尾熊音色和Edge在线音色等来源。
本地语音克隆
语音克隆用3-10秒清晰人声建立音色,模型资源准备后可本地生成WAV配音。
使用流程
实际可用能力以当前正式安装包和帮助中心说明为准。
输入配音文案
选择音色来源和音色
试听音色
调整语速
生成音频
试听/保存/打开目录
常见问题
功能边界与操作结果需要结合素材情况判断。
语音克隆需要什么参考音频?
建议使用3-10秒单人清晰人声,避免背景音乐、多人声、回声和长停顿。
语音合成能单独使用吗?
可以。用户只需要输入文本、选择音色和保存位置,即可生成音频文件。