MiniMax发布新一代语音大模型,荣登国际权威评测榜单榜首

  近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际最权威的两项语音评测榜单Artificial Analysis和Hugging Face TTS Arena 上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展意味着我国在AI语音生成领域已跻身世界领先行列。

  就在今年年初,DeepSeek-R1以超低成本实现部分性能超越OpenAI o1的表现,打破了业界对硅谷大模型的”技术迷信”。此次MiniMax在语音AI领域的技术突破,再次证明了我国在大模型研发方面的强大实力。

 (国际权威语音评测榜单Artificial Analysis)(Hugging Face TTS Arena 评测榜单)

  据介绍,Speech-02在语音模型核心技术指标:字错率WER和相似度SIM等客观指标上取得了SOTA结果,用户盲听主观评价反馈也更自然、真实。具体来看,与Seed-TTS、CosyVoice 2和真实音频比,Speech-02在中英文的零样本语音克隆中均实现了更低的WER,表明其发音错误率更低且更清晰稳定。在SIM方面,Speech-02在所有24种测试语言中均显著优于ElevenLabs的multilingual_v2模型,前者生成的语音更逼近真人输出。

  基于超强技术与足够泛化的模型能力,Speech-02为用户带来超拟人、个性化、多样性的语音服务。Speech-02通过「文生音」功能给定自然语言文本描述生成符合描述的音色;通过「声音参考」功能,对任意给定语音实现灵活控制,进行感情、语速、音高、语种等无缝切换;同时支持粤语、葡萄牙语、法语等32个语种,甚至在同一段语音里也可以实现多个语种间的自如切换。

  值得关注的是,Speech-02性能登顶同时其商用定价仅为全球头部语音模型ElevenLabs的四分之一,以超高性能和极致性价比双重优势,推动国产AI语音技术大规模商业化落地。

  该模型的突破性定价策略,不仅大幅降低了企业采用先进语音AI技术的门槛,更为智能客服、语音交互等行业带来颠覆性变革。目前,MiniMax已在文旅导览、金融服务、语音助手、AI教育等应用服务;AI玩具、教育学习机、汽车智能座舱等硬件场景形成成熟解决方案,并与国内外多家知名企业达成深度合作,包括国内声网、阅文集团旗下起点读书、高途教育、香港电视台,以及海外Hedra、Moescape AI、Dusmart等机构。

  今年1月份,MiniMax发布Speech-01语音模型,支持17种语言和上百种音色,快速在北美、英国、澳大利亚、日韩、意大利、巴西等20多个国家和地区实现落地合作。

  “在海外,我们已支持大量内容创作者,通过低门槛的语音工具用自己的声音灵活接单,为广告、短片进行声音表演,赋能零工经济。”MiniMax海外生态负责人Linda介绍,“这次发布的Speech-02能够轻松驾驭32个语种的不同口音和不同情绪,我们相信通过AI,通过对稀缺小语种的支持,未来将多语种的声音以当地最地道的发音传向全世界,帮助全球每一种语言都被听见、每一种文化都被理解”。

文章来源于网络。发布者:火星财经,转载请注明出处:https://www.sengcheng.com/article/57969.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
火星财经的头像火星财经
上一篇 2025年5月16日 上午11:45
下一篇 2025年5月16日 上午11:46

相关推荐

  • 谷爱凌夺冠后发文 坚韧意志再创辉煌

    谷爱凌在瑞士莱克斯举行的坡面障碍技巧世界杯女子决赛中再次夺冠,为她的职业生涯增添了浓墨重彩的一笔。比赛中,她以高超的技巧和稳定的发挥,两次滑出80分以上的超高分数,最终力压群雄赢得冠军,并与获得银牌和铜牌的选手共同庆祝这一喜悦时刻。 此次胜利体现了谷爱凌作为一名全能型滑雪选手的实力和韧性。她擅长大跳台、坡面障碍技巧和U型池三个项目,在每个项目中都展现出了极高…

    2025年1月18日
    17800
  • A股早评:沪指微涨0.05%,雅下水电概念上下游继续爆发!西宁特钢、保利联合、高争民爆、华新水泥等股2连板

      格隆汇7月22日|A股开盘,沪指涨0.05%,深证成指跌0.03%,创业板指跌0.07%。盘面上,雅下水电概念上下游继续爆发,工程机械、水泥、水利等方向领涨,西宁特钢(600117)、保利联合、高争民爆(002827)、华新水泥(600801)等股走出2连板;现货黄金突破3400美元关口创新高,带动黄金股高开,湖南白银、西部黄金(601069)涨超2%;…

    2025年7月22日
    11400
  • 微信再更新!能查微信通话记录了

    1月18日,微信更新了Callkit了冲上热搜。 近日社交媒体上,大量用户发现自己微信居然突然拥有了CallKit功能,表示非常意外。 CallKit功能指可将第三方网络通信集成在iPhone自带的通话功能中,以提供更灵活的通话体验。 例如在来微信语音和视频通话时,会在横幅显示来电的名称、拒绝和接受按钮选项。 值得注意的是,在系统的通话记录里面也能看到自己的…

    2025年1月24日
    15400
  • 暂勿前往!极高安全风险!我使馆紧急提醒 阿富汗恐袭频发

    当地时间13日,中国驻阿富汗使馆发布安全提示,提醒中国公民近期暂勿前往阿富汗。近期阿富汗发生多起恐袭事件,造成重大人员伤亡。如坚持前往,当事人可能面临极高安全风险,并影响获得领事协助的实效。 已在当地的中国公民和在阿机构应保持高度警惕,完善住地安全防范措施,减少非必要外出。如确需出行,请务必安排持枪安保人员随卫,并尽量避免前往人群密集场所或长时间逗留。 如遇…

    2025年2月15日
    12800
  • 体积更小功率更大 新材料为机器人产业做“镓”衣

    左图为英诺赛科氮化镓(GaN)芯片,右图为意优科技展厅现场。 康殷/供图 证券时报记者 康殷 2025年是人形机器人量产元年,氮化镓(GaN)半导体正以“性能革命者”的姿态,缩短机器人从实验室走向规模化商用的距离。 相较于传统硅基芯片,这种第三代半导体材料凭借高频、高能效、耐高压等特性,成为破解机器人关节驱动精度、功率密度与散热难题的“金钥匙”,为机器人产业…

    2025年7月12日
    11600

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

关注微信