VoiceStudio
为内容创作者和开发者提供本地化语音克隆、视频配音与有声书制作的一体化桌面工具
支持语音克隆、视频本地化、听写转写和有声书制作的桌面语音 AI 工具
项目介绍
VoiceStudio(原 OmniVoice Studio)是一个开源、以本地运行为主的桌面语音 AI 工具,面向需要配音、语音克隆、视频本地化、听写转写和有声书制作的创作者、开发者及团队。它将多种语音处理任务集中在桌面应用中,适合希望在本机处理语音内容的用户。 用户可以导入短音频建立克隆声音,也可以通过文字描述设计新的声音;上传视频后,平台能够完成转写、翻译和重新配音,并处理说话人与时间关系。长脚本或 EPUB 可用于制作多角色有声书,音频和视频也能转换为可编辑、可检索的文本。页面显示其语音目录覆盖多种语言,但具体范围会随使用的引擎而变化。 核心功能 本地语音克隆与设计:上传一段较短的声音样本即可创建克隆音色,也能设置性别、年龄、口音、音高和情绪等条件设计新声音。 视频翻译与配音:导入视频后完成语音转写、内容翻译和重新配音,并尽量保留不同说话人的分段和原有时间关系。 音频视频转写:将音频或视频转换为可编辑、可搜索的文字内容,适合整理访谈、会议、课程和视频素材。 多角色有声书制作:导入长篇脚本或 EPUB,为不同角色分配声音并生成分章节的有声书内容。 适合谁 需要制作旁白、配音和角色声音的内容创作者。 需要进行视频翻译和多语言本地化的团队。 经常整理访谈、课程、会议录音的用户。 希望制作多角色有声书或长篇音频内容的创作者。 需要调用本地语音能力的开发者。 使用方式 下载并安装适合 Windows、macOS 或 Linux 的 VoiceStudio。 在应用中选择或管理需要使用的本地语音引擎和模型。 根据任务导入文字、声音样本、音频、视频或 EPUB 文件。 设置声音、语言及相关生成参数,开始克隆、配音、转写或有声书制作。 在应用中检查生成结果,并继续编辑或处理输出内容。