🎙️ 语音克隆

基于本地后端的语音克隆与说话人分离演示

选择模型

当前页面统一接入本地 standard 后端,lite 和 premium 选项会映射到同一套可用模型。

兼容
Lite
映射到 standard
保留轻量入口,实际调用本地 standard 模型。
当前可用
Standard
本地模型
支持语音克隆、多人分离和批量处理。
兼容
Premium
映射到 standard
保留高级入口,实际调用本地 standard 模型。

上传参考音频

拖拽音频到此处,或点击选择文件

支持格式: WAV、MP3、M4A、OGG、FLAC

0.8

上传多人音频

上传包含多位说话人的音频以进行分离

4
2.0

批量语音克隆

上传多个参考音频,批量生成克隆结果