VoiceStudio平替ElevenLabs,在一个开源桌面工作室里完成克
隆、设计、配音、听写和有声书制作。
默认本地优先。没有订阅,也没有用量计费;联网服务始终由你
主动选择。
三步克隆出你的第一个声音:
安装并启动。首次启动会自动搭建Python运行环境并下载模型权重–启动画面会逐步显示进度(仅首次,需要几分钟;之后即开即用)。
从启动台打开语音克隆,拖入任意声音的3秒音频。输入一句话,点击生成。音频在你的设备上生成并保存,支持646种语言(商业使用前请审阅所选模型与分词器的许可条款)。
功能:
语音克隆
3秒音频>复刻任何声音。
646种语言,零样本。
声音设计
性别、年龄、口音、音高、语速、青感、方言–随心调节。
视频配音
/T链接或文件一>转录一>
翻译>重新配音>MP4。
有声书编辑器
导入文本、EPUB或PDF。自动分章、
响度归一、元数据。导出.m4b。
|





