小米最新开源!覆盖600+语种方言声音克隆TTS,只需3-10秒声音,可控一键合成声音,超40倍速OmniVoice

2026年5月30日13:00:52小米最新开源!覆盖600+语种方言声音克隆TTS,只需3-10秒声音,可控一键合成声音,超40倍速OmniVoice已关闭评论 84 次浏览

小米最新开源!覆盖600+语种方言声音克隆TTS,只需3-10秒声音,可控一键合成声音,超40倍速OmniVoice

小米最新开源!覆盖600+语种方言声音克隆TTS,只需3-10秒声音,可控一键合成声音,超40倍速OmniVoice

软件介绍

OmniVoice是一款最先进的大规模多语言零样本文本到语音(TTS)模型,支持超过600种语言。该模型基于一种新颖的扩散语言模型架构,能够以卓越的推理速度生成高质量语音,并支持语音克隆和声音设计。

超广语言覆盖:支持600+语言,零样本TTS中覆盖最广。

零样本语音克隆:仅需3–10秒参考音频,无需训练即可复刻音色,质量顶尖。

自由语音设计:用文本指令控制性别、年龄、音高、口音/方言、耳语等,无需参考音。

极速推理:RTF低至0.025,比实时快40倍,适合批量与实时场景。

精细发音控制:支持笑声/叹气等非语言标记,支持拼音/音标强制纠音。

架构简洁高效:扩散语言模型结构,兼顾音质、速度与扩展性。

易用部署:一键启动Web UI,已经制作好了离线整合包给大家使用,大家有需要的可以试试。

完全开源:GitHub开源,可本地部署(已经可以本地离线运行了)、二次开发与商用友好。

PS:支持如下方言:

陕西话、河南、四川话、贵州话、云南话、桂林话、济南话、石家庄话、甘肃话、宁夏话、青岛话、东北话

适用设备

电脑软件

夸克网盘链接

*提示本文仅为课程介绍,不构成任何收益承诺,变现效果因人而异,需结合自身努力与实操,合理运用课程所学内容,同时严格遵守平台相关规则与相关法律法规*

感兴趣的可以下载学习,此资源免费,可以直接下载,资源失效请添加冒泡网创QQ:1543952060或者838912514补(冒泡网创永久地址发布页,收藏我回家不迷路!

资源获取:

链接:https://pan.quark.cn/s/97802994cf18

  • 冒泡QQ群1103998763
  • weinxin
  • 我的微信maomp02
  • weinxin