AI独角兽MiniMax发布新一代语音大模型Speech-02 荣登国际权威评测双榜榜首_财经评论(cjpl)股吧

股吧首页 > 财经评论吧 > 正文

最近访问：

财经评论吧

返回财经评论吧>>

- 重要股东股权质押数据全览

东方财富资讯君

发表于 2025-05-16 11:00:10 股吧网页版

AI独角兽MiniMax发布新一代语音大模型Speech-02 荣登国际权威评测双榜榜首

来源：上海证券报·中国证券网作者：孙小程

　　上证报中国证券网讯（记者孙小程）近日，来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上，力压OpenAI、ElevenLabs等国际巨头，荣登双榜榜首。这一突破性进展，意味着我国在AI语音生成领域已跻身世界领先行列。

　　据介绍，Speech-02在语音模型核心技术指标字错率WER和相似度SIM等客观指标上取得了SOTA结果，用户盲听主观评价反馈也更自然、真实。具体来看，与Seed-TTS、CosyVoice 2和真实音频相比，Speech-02在中英文的零样本语音克隆中均实现了更低的WER，表明其发音错误率更低且更清晰稳定。在SIM方面，Speech-02在所有24种测试语言中均显著优于ElevenLabs的multilingual_v2模型，前者生成的语音更逼近真人输出。

　　基于超强技术与足够泛化的模型能力，Speech-02为用户带来超拟人、个性化、多样性的语音服务。Speech-02通过“文生音”功能给定自然语言文本描述生成符合描述的音色；通过“声音参考”功能，对任意给定语音实现灵活控制，进行感情、语速、音高、语种等无缝切换；同时，支持粤语、葡萄牙语、法语等32个语种，甚至在同一段语音里也可以实现多个语种间的自如切换。

　　值得关注的是，Speech-02商用定价仅为全球头部语音模型ElevenLabs的四分之一，以超高性能和极致性价比双重优势，推动国产AI语音技术大规模商业化落地。

　　目前，MiniMax已在文旅导览、金融服务、语音助手、AI教育等应用服务；AI玩具、教育学习机、汽车智能座舱等硬件场景形成成熟解决方案，并与国内外多家知名企业达成深度合作，包括国内声网、阅文集团旗下起点读书、高途教育、香港电视台，以及海外Hedra、Moescape AI、Dusmart等机构。

　　今年1月，MiniMax发布Speech-01语音模型，支持17种语言和上百种音色，快速在北美、英国、澳大利亚、日韩、意大利、巴西等20多个国家和地区实现落地合作。

　　“在海外，我们已支持大量内容创作者，通过低门槛的语音工具用自己的声音灵活接单，为广告、短片进行声音表演，赋能零工经济。”MiniMax海外生态负责人Linda介绍，“这次发布的Speech-02能够轻松驾驭32个语种的不同口音和不同情绪。我们相信，通过AI，通过对稀缺小语种的支持，未来，将多语种的声音以当地最地道的发音传向全世界，帮助全球每一种语言都被听见、每一种文化都被理解。”

（文章来源：上海证券报·中国证券网） [点击查看原文]

郑重声明：用户在财富号/股吧/博客等社区发表的所有信息（包括但不限于文字、视频、音频、数据及图表）仅代表个人观点，与本网站立场无关，不对您构成任何投资建议，据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容，远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息，谨防上当受骗！

评论该主题

帖子不见了！怎么办？

作者：您目前是匿名发表登录 | 5秒注册作者：，欢迎留言退出发表新主题

郑重声明：用户在社区发表的所有资料、言论等仅代表个人观点，与本网站立场无关，不对您构成任何投资建议。用户应基于自己的独立判断，自行决定证券投资并承担相应风险。《东方财富社区管理规定》