首页 > 热点雷达站 >Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia,支持精细化调节音频的音色 / 情绪 / 语调

Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia,支持精细化调节音频的音色 / 情绪 / 语调

2025-04-27 20:50:23若宝软件园

本站 4 月 24 日消息,由两名韩国研究者组建的 Nari Labs 工作室于前天在GitHub和Hugging Face开源了拥有 16 亿参数的文字转语音AI模型Dia,目前相应模型已在GitHub上收获了超过 9300 颗星标,本站附项目 GitHub页如下:https://github.com/nari-labs/dia

相应研究者声称Dia的音质相对于业界的文字转语音模型拥有更灵活的自由度,同时在生成的语音自然度方面超越了 ElevenLabs Studio、Sesame等竞品。其支持对输出音频的音色、情绪和语调进行精细调节,还能模拟各种非语言交流(如大笑、咳嗽或清嗓子等)。

官方对比测试显示,Dia在声调自然度、表情丰富度和语音节奏感方面,均优于专注自然语音合成的ElevenLabs Studio以及Sesame推出的对话语音模型CSM-1B。

目前,Dia仅支持英文,需要英伟达RTX 3080及以上显卡才能本地部署运行,不过用户也可以在Hugging Face Spaces线上平台中在线使用。Nari Labs表示,后续将推出面向普通消费者的一键部署服务,进一步降低使用门槛,让更多人无缝体验高质量文本转语音技术。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表本站立场。文章及其配图仅供学习分享之

5911
471

同类推荐更多

黄金网站9.1免费入口:如何利用黄金网站提升你的网络体验?

黄金网站9.1免费入口:如何利用黄金网站提升你的网络体验?

最火的热点雷达站

2025-03-27

随着互联网的发展,越来越多的人选择通过网络平台进行各种在线活动,黄金网站9 1免费入口成为了许多人了解和使用的一个重要工具。对于那些热衷于网络浏览和各种在线服务的用户来说,了解如何高效利用这个平台,能够极大地提升日常生活和工作中的网络体验。 黄金网站9 1免费入口的独特优势 黄金网站9 1免费入口不仅仅是一个普通的访问入口,更是一个拥有丰富资源和便捷功能的平台。通过这个平台,用户能够享受到多种免