AI独角兽MiniMax发布新一代语音大模型Speech-02 荣登国际权威评测双榜榜首

上海证券报·中国证券网 05-16 10:58

上证报中国证券网讯(记者孙小程)近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

据介绍,Speech-02在语音模型核心技术指标字错率WER和相似度SIM等客观指标上取得了SOTA结果,用户盲听主观评价反馈也更自然、真实。具体来看,与Seed-TTS、CosyVoice 2和真实音频相比,Speech-02在中英文的零样本语音克隆中均实现了更低的WER,表明其发音错误率更低且更清晰稳定。在SIM方面,Speech-02在所有24种测试语言中均显著优于ElevenLabs的multilingual_v2模型,前者生成的语音更逼近真人输出。

基于超强技术与足够泛化的模型能力,Speech-02为用户带来超拟人、个性化、多样性的语音服务。Speech-02通过“文生音”功能给定自然语言文本描述生成符合描述的音色;通过“声音参考”功能,对任意给定语音实现灵活控制,进行感情、语速、音高、语种等无缝切换;同时,支持粤语、葡萄牙语、法语等32个语种,甚至在同一段语音里也可以实现多个语种间的自如切换。

值得关注的是,Speech-02商用定价仅为全球头部语音模型ElevenLabs的四分之一,以超高性能和极致性价比双重优势,推动国产AI语音技术大规模商业化落地。

目前,MiniMax已在文旅导览、金融服务、语音助手、AI教育等应用服务;AI玩具、教育学习机、汽车智能座舱等硬件场景形成成熟解决方案,并与国内外多家知名企业达成深度合作,包括国内声网阅文集团旗下起点读书、高途教育、香港电视台,以及海外Hedra、Moescape AI、Dusmart等机构。

今年1月,MiniMax发布Speech-01语音模型,支持17种语言和上百种音色,快速在北美、英国、澳大利亚、日韩、意大利、巴西等20多个国家和地区实现落地合作。

“在海外,我们已支持大量内容创作者,通过低门槛的语音工具用自己的声音灵活接单,为广告、短片进行声音表演,赋能零工经济。”MiniMax海外生态负责人Linda介绍,“这次发布的Speech-02能够轻松驾驭32个语种的不同口音和不同情绪。我们相信,通过AI,通过对稀缺小语种的支持,未来,将多语种的声音以当地最地道的发音传向全世界,帮助全球每一种语言都被听见、每一种文化都被理解。”

(文章来源:上海证券报·中国证券网)

文章来源:上海证券报·中国证券网
文章作者:孙小程
原标题:AI独角兽MiniMax发布新一代语音大模型Speech-02 荣登国际权威评测双榜榜首
郑重声明:东方财富发布此内容旨在传播更多信息,与本站立场无关,不构成投资建议。据此操作,风险自担。
热点阅读
关税大消息!特朗普突然宣布!将在未来两到三周内为贸易伙伴设定新的关税税率
关税大消息!特朗普突然宣布!将在未来两到三周内为贸易伙伴设定新的关税税率
券商中国 1104评论
最后的AAA也没了!穆迪正式宣布下调美国主权信用评级
最后的AAA也没了!穆迪正式宣布下调美国主权信用评级
财联社 322评论
上市公司重大资产重组新规九要点:引入私募“反向挂钩” 压缩审核流程
上市公司重大资产重组新规九要点:引入私募“反向挂钩” 压缩审核流程
澎湃新闻 69评论
3月中国减持189亿美元美债、持仓规模降至第三 英国升至第二
3月中国减持189亿美元美债、持仓规模降至第三 英国升至第二
澎湃新闻 140评论
打开东方财富APP查看更多内容
24小时点击排行
接下来的陪太子读书时间2025.5.16
把握难得的挣钱机会
毛利率超过90%,盈利能力堪比茅台,巴菲特看了都流哈喇子的印钞机企业!
黄晓明读博士,知识和智慧才是守住财富的良方
证监会放利好 晚间四大消息
点击查看更多内容
写评论 ...