Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia,支持精细化调节音频的音色 / 情绪 / 语调
作者:方泰攻略站时间:2025-04-27 20:50:06
本站 4 月 24 日消息,由两名韩国研究者组建的 Nari Labs 工作室于前天在GitHub和Hugging Face开源了拥有 16 亿参数的文字转语音AI模型Dia,目前相应模型已在GitHub上收获了超过 9300 颗星标,本站附项目 GitHub页如下:https://github.com/nari-labs/dia
相应研究者声称Dia的音质相对于业界的文字转语音模型拥有更灵活的自由度,同时在生成的语音自然度方面超越了 ElevenLabs Studio、Sesame等竞品。其支持对输出音频的音色、情绪和语调进行精细调节,还能模拟各种非语言交流(如大笑、咳嗽或清嗓子等)。
官方对比测试显示,Dia在声调自然度、表情丰富度和语音节奏感方面,均优于专注自然语音合成的ElevenLabs Studio以及Sesame推出的对话语音模型CSM-1B。
目前,Dia仅支持英文,需要英伟达RTX 3080及以上显卡才能本地部署运行,不过用户也可以在Hugging Face Spaces线上平台中在线使用。Nari Labs表示,后续将推出面向普通消费者的一键部署服务,进一步降低使用门槛,让更多人无缝体验高质量文本转语音技术。
相关文章
-
Nari Labs 开源 16 亿参数文字转语音 AI 模型 Dia,支持精细化调节音频的音色 / 情绪 / 语调
本站 4 月 24 日消息,由两名韩国研究者组建的 Nari Labs 工作室于前天在GitHub和Hugging Face开源了拥有 16 亿参数的文字转语音AI模型Dia,目前相应模型已在GitH
-
OPPO 法务部:Find X8 Ultra 手机发热的不实内容,由部分自媒体编造虚假使用体验
本站 4 月 24 日消息,OPPO 法务部今晚发布《关于 OPPO Find X8 Ultra 手机发热谣言的澄清声明》,本站附原文如下:近期网络上出现 OPPO Find X8 Ultra 手机发
-
支持大折叠手机作为平板设备登录,微信鸿蒙版 App 获 1.0.6.33 邀测升级
感谢本站网友 朱丶工作室、自信的眉毛、Anytimeps、zhao_31 的线索投递! 本站 4 月 24 日消息,微信鸿蒙版 App 今日在华为应用市场
-
苹果 iPadOS 19 新功能曝光:iPad 连接妙控键盘时将显示类似 Mac 的菜单栏
本站 4 月 25 日消息,据爆料人 Majin Bu 的消息,当 iPad 运行 iPadOS 19 并连接到妙控键盘时,屏幕上将出现一个类似 macOS 的菜单栏。这一变化将进一步模糊 iPad
-
苹果剖析 App Store 智能总结功能,AI 如何浓缩应用 / 游戏评价精髓
本站 4 月 25 日消息,苹果公司在 iOS 18 4 系统更新中,为 App Store 应用商店推出新功能,可以智能分析多条用户评价,并生成简洁的总结,帮助用户概览应用 游戏反馈。苹果机器学
-
.net →.com:Meta 社交平台 Threads 迁移域名,并推网页新功能
本站 4 月 25 日消息,Meta 公司今天发布公告,宣布旗下社交媒体平台 Threads 迁移域名,正式从 Threads net 迁移至 Threads com。本站注:Meta 公司于 202