首页 生活常识 百科知识 范文大全 经典语录 家电维修 实时讯息

Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia,支持精细化调节音频的音色 / 情绪 / 语调刷爆头条

2025-07-05 07:07     更新时间:2025-07-05 07:06:33     82次浏览
Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia,支持精细化调节音频的音色 / 情绪 / 语调
Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia,支持精细化调节音频的音色 / 情绪 / 语调 2025年04月24日 22:33 IT之家

IT之家 4 月 24 日消息,由两名韩国研究者组建的 Nari Labs 工作室于前天在 GitHub 和 Hugging Face 开源了拥有 16 亿参数的文字转语音 AI 模型 Dia,目前相应模型已在 GitHub 上收获了超过 9300 颗星标,IT之家附项目 GitHub 页如下:narilabs/dia

相应研究者声称 Dia 的音质相对于业界的文字转语音模型拥有更灵活的自由度,同时在生成的语音自然度方面超越了 ElevenLabs Studio、Sesame 等竞品。其支持对输出音频的音色、情绪和语调进行精细调节,还能模拟各种非语言交流(如大笑、咳嗽或清嗓子等)。

官方对比测试显示,Dia 在声调自然度、表情丰富度和语音节奏感方面,均优于专注自然语音合成的 ElevenLabs Studio 以及 Sesame 推出的对话语音模型 CSM1B。

目前,Dia 仅支持英文,需要英伟达 RTX 3080 及以上显卡才能本地部署运行,不过用户也可以在 Hugging Face Spaces 线上平台中在线使用。Nari Labs 表示,后续将推出面向普通消费者的一键部署服务,进一步降低使用门槛,让更多人无缝体验高质量文本转语音技术。



  • 上一篇 >

相关文章:

今日最新无缝钢管价格行情查询(2025年4月2407-05

今天彩涂板卷价格行情查询(2025年4月24日)07-05

(2025年04月24日)今日dmf价格行情最新报价07-05

今日造船板价格行情查询(2025年4月24日)内07-05

(2025年04月24日)今日烧碱价格行情查询头07-05

(2025年04月23日)今日LLDPE价格行情最新报07-05

(c)2008-2028 www.jiazhengayi.com 家政阿姨网 -生活类B2B门户网 SYSTEM All Rights Reserved