小米 AI 实验室发布 ZipVoice 系列语音合成 TTS 模型,解决零样本语音合成痛点
9 月 12 日消息,小米集团 AI 实验室今日宣布,旗下 Kaldi 团队上个月发布了基于 Flow Matching 架构的 ZipVoice 系列语音合成(TTS)模型,包括:
ZipVoice(零样本单说话人语音合成模型)
ZipVoice-Dialog(零样本对话语音合成模型)
据最新介绍,作为 zipformer 在语音生成任务上的应用和探索,ZipVoice 解决了现有零样本语音合成模型的参数量大、合成速度慢的痛点,在轻量化建模和推理加速上取得了重要突破。
ZipVoice-Dialog 则解决了现有对话语音合成模型在稳定性和推理速度上的瓶颈,实现了又快又稳又自然的语音对话合成。

从小米最新获悉,ZipVoice 首次将原本为自动语音识别(ASR)设计的 Zipformer 架构引入 TTS 任务作为模型的骨干网络,Zipformer 中的三大设计:基于 U-Net 的多尺度高效率结构、卷积与注意力机制的协同处理、以及注意力权重的多次复用都高度适配语音合成任务,从而实现了语音合成模型的高效建模。
得益于这一设计,相比基于 DiT 的语音合成模型,在性能相似的情况下,ZipVoice 的参数量减少了约 63%。

性能方面,ZipVoice 和 ZipVoice-Distill 在具备更小参数量和更快推理速度的同时,在三个客观指标,即说话人相似度(SIM-o)、词错误率(WER)和 UTMOS,以及两个主观指标(CMOS、SMOS)上都极具竞争力,达到了零样本语音合成模型的 SOTA 性能水平,同时显著减少了模型参数量,加快了推理速度。

小米最新表示,ZipVoice 零样本语音合成模型具备了低参数量、高推理速度、高语音质量三大优点,ZipVoice-Dialog 提供了又快又稳又好的对话语音合成新方案。ZipVoice 系列模型为轻量化、高速度要求的语音交互应用场景提供了新的解决方案。
此外,小米表示未来团队将持续对 ZipVoice 系列模型进行优化,致力于让每一个人都能享受到低成本高质量的语音合成技术。
参考地址:
ZipVoice 系列的模型文件、训练代码和推理代码以及 6.8k 小时的语音对话数据集 OpenDialog 已全部开源:https://github.com/ k2-fsa / ZipVoice
Zipvoice 论文已被 ASRU2025 接收:https://arxiv.org/ pdf/2506.13053
样例体验请访问:https://zipvoice.github.io
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
Nuu B40 5G手机发布 搭载天玑7025芯片与1.6英寸背屏
NuuB405G手机全球发布,配备1 6英寸AMOLED背屏与天玑7025芯片。背屏可显示通知、充当后置自拍取景器。正面为6 7英寸120Hz曲面屏,后置6400万像素主摄。手机搭载8GB+256GB存储,内置5000mAh电池,支持33W快充,运行Android15系统,售价约249 99美元。
倪飞回应豆包订餐厅被拒 手机App预约功能缺失问题解析
用户通过豆包App预约餐厅被拒,店员称不支持该方式。豆包客服解释平台暂无实际预约功能,无法代传信息。倪飞回应称,独立App可能不支持预约,但集成豆包手机助手的“豆包手机”可实现该功能。演示显示手机能理解语音指令并直接调用服务完成预约,体现了“指令直达服务终点”的能力,有望简化操。
上海科技节开幕聚焦好问题 探索科学创新源头
2026年上海科技节以“科技让生活更美好”为主题,开启为期一周的全民科技嘉年华。开幕式“智境红毯”汇聚院士、科研先锋与少年英才,展现科创活力。科学家强调培育科学精神与好奇心,并分享前沿成果。全市推出近2000场活动,开放大科学设施与科普基地,促进科技与公众深度互动,并通过“好问题开放麦。
联想 IdeaPad Slim 3i 17 英寸笔记本发布 搭载英特尔 Wildcat Lake 平台
联想在海外推出IdeaPadSlim3i17IWC11笔记本,配备17 3英寸1080P屏幕,主打大屏办公与影音娱乐。其提供酷睿5或酷睿7处理器选项,支持用户自行升级内存至32GB及存储至1TB。接口齐全,包含USB-C、HDMI等,电池续航宣称最长超18小时。该产品定价在不同市场有所差异,定位为实用型大屏办公本。
Epic诉苹果藐视法庭裁决 苹果提请最高法院复审
苹果就与Epic的反垄断诉讼向最高法院提出请求,核心争议在于法院是否应依据禁令“精神”认定苹果藐视法庭,以及禁令适用范围是否过宽。苹果援引判例称禁令应仅限Epic。此前法院认定苹果通过设置外部支付限制规避2021年禁令构成藐视,上诉法院维持认定但指出苹果有权收取合理费用,案件或发。
- 日榜
- 周榜
- 月榜
1
2
3
4
5
6
7
8
9
10
相关攻略
2015-03-10 11:25
2015-03-10 11:05
2021-08-04 13:30
2015-03-10 11:22
2015-03-10 12:39
2022-05-16 18:57
2025-05-23 13:43
2025-05-23 14:01
热门教程
- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程
热门话题

