TG下载

TG:动态|MiniMax发布新一代语音大模型Speech-02同时支持粤语、葡萄牙语、法语等32个语种

动态 2025-05-18 13:11

  近日,MiniMax发布新一代语音大模型Speech-02。该模型在国际权威的两项语音评测榜单Artificial Analysis和Hugging Face TTS Arena 上荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

  据介绍,Speech-02在语音模型核心技术指标:字错率WER和相似度SIM等客观指标上取得了“SOTA”结果,用户盲听主观评价反馈也更自然、真实。

  具体来看,与Seed-TTS、CosyVoice 2和真实音频相比,Speech-02在中英文的零样本语音克隆中均实现了更低的WER,表明其发音错误率更低且更清晰稳定。在SIM方面,Speech-02在所有24种测试语言中均显著优于ElevenLabs的multilingual_v2模型,前者生成的语音更逼近真人输出。

  Speech-02可以为用户带来超拟人、个性化、多样性的语音服务。Speech-02通过「文生音」功能给定自然语言文本描述生成符合描述的音色;通过「声音参考」功能,对任意给定语音实现灵活控制,进行感情、语速、音高、语种等无缝切换;同时支持粤语、葡萄牙语、法语等32个语种,甚至在同一段语音里也可以实现多个语种间的自如切换。

  值得关注的是,Speech-02性能登顶同时其商用定价仅为全球头部语音模型ElevenLabs的四分之一,以超高性能和极致性价比双重优势,推动国产AI语音技术大规模商业化落地。

  该模型的突破性定价策略,不仅大幅降低了企业采用先进语音AI技术的门槛,更为智能客服、语音交互等行业带来颠覆性变革。

  目前,MiniMax已在文旅导览、金融服务、语音助手、AI教育等应用服务;AI玩具、教育学习机、汽车智能座舱等硬件场景形成成熟解决方案,并与国内外多家知名企业达成深度合作,包括国内声网、阅文集团旗下起点读书、高途教育,以及海外Hedra、Moescape AI、Dusmart等机构。

  今年1月份,MiniMax发布Speech-01语音模型,支持17种语言和上百种音色,快速在北美、英国、澳大利亚、日韩、意大利、巴西等20多个国家和地区实现落地合作。

  “在海外,我们已支持大量内容创作者,通过低门槛的语音工具用自己的声音灵活接单,为广告、短片进行声音表演,赋能零工经济。”MiniMax海外生态负责人Linda介绍,“这次发布的Speech-02能够轻松驾驭32个语种的不同口音和不同情绪,我们相信通过AI,通过对稀缺小语种的支持,未来将多语种的声音以当地最地道的发音传向全世界,帮助全球每一种语言都被听见、每一种文化都被理解”。

  今年年初,DeepSeek-R1以超低成本实现部分性能超越OpenAI o1的表现,打破了业界对硅谷大模型的技术迷信。此次MiniMax在语音AI领域的技术突破,再次证明了我国在大模型研发方面的强大实力。

  行业分析人士指出,这种技术突破+商业落地的双轮驱动模式,标志着我国人工智能产业已进入高质量发展新阶段。随着核心技术的持续突破和应用场景的不断拓展,国产大模型正在全球AI竞赛中跑出中国速度。

  特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

  看完热搜上那对“一夜返贫”的夫妻,我终于明白普通人的存款天花板在哪里……

  5月17日央视直播世乒赛时间表 国乒8场外战对阵名单 CCTV5节目单

  卸任8只产品!又一百亿“宝藏”基金经理辞职或“奔私”,最佳回报375%

  宏碁发布 Iconia V12/V11 安卓平板:Helio G99芯片、8000mAh电池

  唯一骁龙8至尊版小钢炮!联想拯救者平板Y700四代上架:国补价2804元起

  英特尔酷睿 Ultra 7 265K进一步变相降价:赠送32GB内存和2款游戏

上一篇:MiniMax稀宇极智发布新一代语音大模型Speech-02

下一篇:没有了

猜你喜欢