产品信息
什么是 Voicebox?
Voicebox 是一种基于Meta的非自动性流量匹配模型构建的最先进的语音生成模型。通过学习通过大规模数据来解决文本指导的语音填充任务,Voicebox 通过context学习在语音任务上均优于单一目的AI模型。Voicebox 可以跨六种语言综合语音,删除瞬态噪声,编辑内容,在语言内和跨语言中传输音频样式,并生成多样化的语音样本。更糟糕的是,它的语音比最先进的自动回归型号快20倍。
如何使用 Voicebox?
Voicebox是一个先进的语音生成模型,它通过上下文学习在多种语音任务上超越了单一用途的AI模型。该模型能够合成六种语言的语音、去除瞬态噪音、编辑内容、转换音频风格,并生成多样化的语音样本。
Voicebox 的核心功能
文本转语音
消除噪音
AI驱动
多语言
语音合成
文字转语音
多种语言
Voicebox 的使用场景
- 生成多语言的语音内容
- 对现有音频进行噪音去除和内容编辑
- 将特定音频的风格应用于新的语音
- 快速创建多样化的语音样本
Voicebox 的常见问题
Voicebox做什么的?
我如何使用Voicebox?
Voicebox有哪些核心功能?
Voicebox有哪些应用场景?



















