首页 > 爱酱攻略 > Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia，支持精细化调节音频的音色 / 情绪 / 语调

Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia，支持精细化调节音频的音色 / 情绪 / 语调

时间：2025-04-25来源：爱酱手游网

本站 4 月 24 日消息，由两名韩国研究者组建的 Nari Labs 工作室于前天在GitHub和Hugging Face开源了拥有 16 亿参数的文字转语音AI模型Dia，目前相应模型已在GitHub上收获了超过 9300 颗星标，本站附项目 GitHub页如下：https://github.com/nari-labs/dia

相应研究者声称Dia的音质相对于业界的文字转语音模型拥有更灵活的自由度，同时在生成的语音自然度方面超越了 ElevenLabs Studio、Sesame等竞品。其支持对输出音频的音色、情绪和语调进行精细调节，还能模拟各种非语言交流（如大笑、咳嗽或清嗓子等）。

官方对比测试显示，Dia在声调自然度、表情丰富度和语音节奏感方面，均优于专注自然语音合成的ElevenLabs Studio以及Sesame推出的对话语音模型CSM-1B。

目前，Dia仅支持英文，需要英伟达RTX 3080及以上显卡才能本地部署运行，不过用户也可以在Hugging Face Spaces线上平台中在线使用。Nari Labs表示，后续将推出面向普通消费者的一键部署服务，进一步降低使用门槛，让更多人无缝体验高质量文本转语音技术。

上一篇：云帆小说手机版app下载-云帆小说免费手机版正式下载v5.38.01

下一篇：荣耀平板GT震撼登场：144Hz高刷+IMAX音效，首发仅需1699元起！

免责声明：网发此文仅为传递信息，不代表认同其观点或证实其描述。同时文中图片应用自网络，如有侵权请联系删除。

最新资讯更多