VoiceStudio

VoiceStudio

本地运行的ElevenLabs替代

AI官网

应用介绍

想给视频配个外语旁白、把一本书做成有声书,或者用自己的声音批量生成语音,ElevenLabs 这类服务按字符收费,用多了账单吓人,录音和文稿还得全部传到别人的服务器上。

VoiceStudio 把这一整套搬到了自己电脑上:声音克隆、声音设计、视频配音、听写和转录全都本地运行。给一段干净的参考录音就能克隆出声音,输入文字直接合成;把视频拖进去,它会先转写、再翻译、再用目标语言重新配音,原声和配音可以对照试听。支持 646 种语言。

它是开源桌面应用(AGPL-3.0),Windows、macOS、Linux 都能用,GitHub 三万多星。默认用 OmniVoice 引擎,也能换其他语音模型;还提供本地 API 和 MCP,AI Agent 可以直接调用。克隆他人声音请先取得本人许可。

软件功能



声音克隆:用一段参考录音复刻音色,输入文本即可生成语音。

声音设计:不用参考录音,按描述设计出全新的声音。

视频配音:支持 MP4、MKV、MP3 等格式,自动转写、翻译并按时间轴生成目标语言配音,也能直接粘贴视频链接。

听写小窗:悬浮听写组件,说话直接变成文字。

有声书和批量任务:把长文本、故事整理成有声书,批量生成音频。

模型管理:在应用里下载、切换多种语音引擎,按硬件选择合适的模型。

本地 API 与 MCP:通过本地接口和 MCP 把语音能力接进自己的程序或 AI Agent。