阿里AI语音模型全球测试进前五
来源:万德丰发布时间:2026-06-01821浏览
询问 AI据南华早报报道,阿里通义实验室研发的Fun-Realtime-TTS-Preview模型,在“全球语音竞技场”(Speech Arena)的盲测榜单中位列第五。此项评测由旧金山知名人工智能评估机构Artificial Analysis负责运营,该机构曾获得前GitHub首席执行官及Google Brain创始人的支持。凭借在识别复杂方言及地方口音方面的技术积累,该模型在国际权威评测中排名高于OpenAI和xAI等海外竞争者,成为全球前五名中唯一出自中国研发团队的语音系统。
此外,在字错误率(WER)这一关键指标上,该团队的另一款语音识别模型以1.8%的错误率位居第一,有效突破了亚洲语音市场长期存在的技术瓶颈。以往常规语音系统对特定方言和口音的识别准确率通常不足30%。相比之下,阿里的新系统现已兼容30余种语言、7类中国主要方言以及20多种地方口音,同时还为医疗、金融等垂直领域推出了企业级定制接口。
当前,国内人工智能开发者正加快把生成式助手融入日常场景,以拓展更多商业化落地途径。尽管谷歌等美国科技企业在诸多商业语音生态系统中依然保持领先,但中国厂商正依靠更具专业性的实际应用产品发起挑战,并逐渐将语音交互作为布局跨行业人工智能的关键切入点。
新闻来源:万德丰,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。

