产品信息
什么是 Dia tts model?
DIA是NARI Labs创建的语音模型的1.6B参数文本。
DIA直接从成绩单中产生高度现实的对话。您可以在音频上调节输出,从而实现情感和音调控制。该模型还可以产生非语言交流,例如笑声,咳嗽,清澈的喉咙等。
为了加速研究,我们正在提供验证验证的模型检查点和推理代码。模型权重托管在拥抱的脸上。该模型目前仅支持英语。
如何使用 Dia tts model?
Dia TTS Model 是一个由 Nari Labs 创建的文本转语音模型,能够直接从文本生成超逼真的对话,并支持通过音频控制情感和语调,还能生成非语言交流。
Dia tts model 的核心功能
AI语音克隆
文本转语音
基于Python
Dia tts model 的使用场景
- 生成超逼真的对话内容
- 为语音输出添加情感和语调控制
- 在对话中融入非语言交流(如笑声、咳嗽、清嗓)
- 为研究人员提供预训练模型和推理代码以加速研究
Dia tts model 的常见问题
Dia TTS Model做什么的?
我如何使用Dia TTS Model?
Dia TTS Model有哪些核心功能?
Dia TTS Model有哪些应用场景?



















