
有声创作
从文本、角色到完整声音作品
适合短文本、长文本、有声书、课程、播客、游戏台词和多人声音作品。广播剧只是其中一种用法。
- 文本转语音
- 长文本配音
- 多人语音合成
- 角色与音色
- AI 音效与 BGM
- 多轨编辑混音

BoboGen 把已经接入的本地模型集中放在一个地方管理。安装并启动对应模型后,文本转语音、语音识别、字幕对齐、音效和音乐等任务可以在自己的设备上完成,不必每次都消耗云端调用额度。需要其他语言、音色或模型时,仍然可以按需配置云端服务。
在一个地方查看模型是否正在运行,需要时启动或停止,再交给有声创作和视频配音使用。
支持 10+ 模型供应商和声音服务。本地模型直接连接;云端服务使用用户自己的账号或 API Key。

代表性接入包括 IndexTTS2、F5-TTS 和 GPT-SoVITS V2Pro,用于文本转语音、角色配音和音色相关任务。
代表性接入包括 MiniMax Speech、Qwen TTS、Seed TTS、腾讯云语音、百度智能云、Edge TTS 和 Browser Speech。
Stable Audio 3 Small SFX 和 Music 可生成剧情音效、环境音和 BGM,结果直接进入素材库和多轨工程。
不同模型共用一套接入规则,客户端按模型能力显示选项;这里的“共享”不是共享用户的项目、素材或密钥。

支持的模型可以使用指令、情绪、停顿和语气词;不支持的项目不会显示。

角色台词与环境声、音效和背景音乐分开编排,可以继续调整位置、时长和混音。

从不同供应商中筛选可用音色,试听后绑定角色,并单独设置语速、音调和音量。

根据章节内容安排环境声、关键音效和配乐,并把确认后的制作方案写入多轨工程。

在时间线上指定位置和时长,用文字描述需要的人声、环境、音效或 BGM。

生成前统一检查音效、环境和 BGM 的模型、描述、位置与时长。

生成后的环境声、音效和 BGM 成为可继续移动、裁剪、混音和替换的轨道片段。

按说话人保存中性、低语、厌恶、害怕、悲伤、惊讶、生气和高兴等参考音频,后续配置角色和项目时可以直接复用。
BoboVox 官网不提供在线 AI 生成、模型推理、在线语音合成、模型 API 中转或模型调用额度。
用户自行申请账号或 API Key,由桌面客户端直接连接并遵守第三方服务规则。
由 BoboVox 提供的本地模型通用服务统一管理和调用本地模型,数据在用户设备内流转。
仅用于账号、登录、订单/会员、软件授权、下载入口、公告和客户支持。
不进入 BoboVox 官网服务器的数据
项目、素材和导出文件由客户端管理;需要模型能力时,由你选择并配置连接方式。
上述名称仅表示技术兼容:桌面客户端可按用户配置进行连接。BoboVox 不提供、代理、转售或运营相关模型服务,也不包含任何模型调用额度。相关商标及服务名称归各权利人所有。
创作版可以免费完成手工制作和标准导出;专业版适合需要 AI 字幕与翻译、批量配音、多语言版本、AI 声音制作和高级导出的用户。两者使用同一个 BoboVox 客户端。
购买只解锁桌面端对应功能,不包含第三方模型账号、调用额度或服务费用。