Voicebox:本地声音克隆、AI 配音与语音转写工作台

摘要

Voicebox 是以本地运行为主的开源 AI 语音工作台,将声音克隆、文字转语音、Whisper 转写和多角色音轨编辑集中在桌面应用中,适合制作解说、学习音频与角色对白。

Voicebox:本地声音克隆、AI 配音与语音转写工作台
Voicebox 是以本地运行为主的开源 AI 语音工作台,将声音克隆、文字转语音、Whisper 转写和多角色音轨编辑集中在桌面应用中,适合制作解说、学习音频与角色对白。
网址: https://voicebox.sh/ 日期:2026-09-11 分类: 评论:发表评论 浏览:14

Voicebox 是以本地运行为主的开源 AI 语音工作台,将声音克隆、文字转语音、Whisper 转写和多角色音轨编辑集中在桌面应用中,适合制作解说、学习音频与角色对白。

Voicebox 可以做什么

  • 从参考音频建立声音档案,或选择预设声音生成配音。
  • 切换 Qwen3-TTS、Chatterbox、Kokoro 等语音引擎;语言、声音克隆和情绪控制能力随引擎不同。
  • 使用多轨时间线组织不同角色的对白,并添加混响、变调等音频效果。
  • 使用 Whisper 转写语音,也可通过 REST API 和 MCP 接入自己的应用与 AI 助手。

安装与入门建议

从官网获取 Windows MSI 或 macOS 安装包;Linux 当前按项目说明从源码构建。安装后先下载需要的模型,以短文本或已获授权的清晰录音测试效果,再尝试长段落与多角色内容。

模型准备完成后可在本机推理,也支持连接远程后端。首次下载需要网络和磁盘空间;运行速度、内存及显存占用取决于模型和硬件,CPU 可用不代表所有模型都能快速生成。

使用前应了解的实际限制

项目 README 当前将 Windows/Linux 听写自动粘贴列在开发计划中,不能把跨应用听写描述为所有系统已有相同体验。声音相似度和中文效果应以所选模型及自己的样本试听为准。

应用代码采用 MIT 许可证,所下载模型的许可需分别查看。仅使用本人或已获许可的声音素材;连接远程后端时,音频和文本的数据去向取决于该后端配置。

资料核对日期:2026 年 9 月 11 日。以上依据Voicebox 官网GitHub 项目说明整理,未进行安装或声音生成实测。

继续浏览智能 AI 网址

网站二维码

发表评论