产品信息
什么是 Gazelle speech language model?
Gazelle是Tincans的联合语音语言模型 - 有关更多详细信息和及时的想法,请参阅我们的V0.2公告。这是一个早期的研究预览 - 请调节期望!瞪羚可以将文本和音频作为输入(互换)并以输出的形式生成文本。您可以通过TTS提供商进一步将文本输出综合为音频(此处未实现)。一些示例任务包括转录音频,回答问题或了解口语音频。这种方法对于延迟和对话质量重要的业务用例(例如客户支持,出站销售等等)将是优越的。
存在已知限制!该模型仅在英语音频上接受培训,并且预计不会与其他语言合作。同样,该模型还不能很好地处理口音。 Gradio演示可能具有带有音频采样率的错误。我们也只接受单个音频输入(麦克风或上传)。
推理是通过模式上的无服务器GPU进行的。因此,您可能会在首次使用时会遇到冷启动延迟(约30秒),但是随后的响应将更快。该演示不是针对推理速度进行优化的,而是为了展示瞪羚的功能。我们不存储任何答复。
如何使用 Gazelle speech language model?
Gazelle是一个由Tincans开发的联合语音语言模型,能够接收文本和音频输入并生成文本输出,旨在通过处理语音和文本来提升商业场景中的交互质量和效率。
Gazelle speech language model 的核心功能
语音转文本
语音转录
语音识别
人工智能驱动
Gazelle speech language model 的使用场景
- 转录音频
- 回答问题
- 理解口语音频
- 客户支持
- 外呼销售
Gazelle speech language model 的常见问题
Gazelle做什么的?
我如何使用Gazelle?
Gazelle有哪些核心功能?
Gazelle有哪些应用场景?



















