出门问问发布TicVoice 7.0 支持超自然语音克隆与跨语种生成能力

116
2025-03-07

3月6日,出门问问(Mobvoi)联合香港科技大学、上海交通大学、南洋理工大学、西北工业大学等顶尖学术机构,共同开源新一代语音生成模型Spark-TTS,并重磅推出其商业化高品质TTS引擎——TicVoice7.0。作为出门问问第七代TTS引擎,TicVoice7.0在语音生成领域实现了重大突破,开启了全新的语音生成范式。


TicVoice7.0的核心优势在于其创新的语音编码方式和建模结构。该引擎采用BiCodec编码技术,将语音编码为互补的两部分:固定序列长度的Global Token和低码率的Semantic Tokens。Global Token负责建模时序无关的全局特征,如音色,确保语音生成的全局可控性;Semantic Tokens则以wav2vec2.0提取的特征为输入,编码与文本紧密相关的信息,确保语义的强相关性。这种设计不仅解决了传统语音编码中存在的问题,还实现了语音token建模与文本token建模的高度统一,使语音生成更加高效且可控。



基于这一创新,TicVoice7.0展现出卓越的语音克隆能力和情感表现力。它能够在3秒内敏锐捕捉声纹特征,让AI不仅能“说人话”,还能模仿人类的叹息、停顿等细微情感表达。相比上一代语音大模型,TicVoice7.0在音色相似度、情感表现及稳定性上均有显著提升,国际通用MOS评分从3.9提升至4.2,情感表现力更强,听感更自然、悦耳且稳定。


此外,TicVoice7.0在个性化定制方面也表现出色。用户可以通过调整性别、语速、基频等多种属性,精准塑造独特的声音风格。在“至臻Pro-精品发音人”定制方面,用户仅需提供20-200句语料,即可获得播音级专业配音体验,国际通用MOS评分从4.3提升至4.7,达到广播级水平,为影视、游戏等场景提供了专业级的语音生成解决方案。


目前,出门问问已将TicVoice7.0落地于旗下AI配音产品“魔音工坊”,为用户带来更好的服务和体验。该引擎不仅在客服、有声书、情感直播、影视解说等应用场景中表现出色,还通过开源生态与产学研深度协同,为行业发展注入了新动能。

78578
文章来源于网络,如有侵权请联系本站删除
精选二手好课
更多>>
次卡|瑜伽课转让
小班课
¥4263
年卡|大刊牛文课转让
大刊牛文课
¥1000
年卡|26考研英语课程转让
考研课
¥600
年卡|优路教育注册监理工程师线上课程
注册监理工程师
¥1800
年卡|一级建造师 优路教育 私教班
一级建造师
¥1000
年卡|注册电气工程师基础考试,英之教育,优培班
注册电气工程师
¥2000
年卡|超格网课转让
教师招聘
¥500
次卡|宁波哈喽贝比早教课时托班
早教课
¥8800
次卡|泰安克莱沃(金色雨林)早教课。配合更名。 还余76节课。一口价8890转。
早教课
¥8890
次卡|昆明海伦国际七田阳光早教课100节
早教课
¥9000
73
AI资讯

出门问问发布TicVoice 7.0 支持超自然语音克隆与跨语种生成能力

收录于合集

3月6日,出门问问(Mobvoi)联合香港科技大学、上海交通大学、南洋理工大学、西北工业大学等顶尖学术机构,共同开源新一代语音生成模型Spark-TTS,并重磅推出其商业化高品质TTS引擎——TicVoice7.0。作为出门问问第七代TTS引擎,TicVoice7.0在语音生成领域实现了重大突破,开启了全新的语音生成范式。


TicVoice7.0的核心优势在于其创新的语音编码方式和建模结构。该引擎采用BiCodec编码技术,将语音编码为互补的两部分:固定序列长度的Global Token和低码率的Semantic Tokens。Global Token负责建模时序无关的全局特征,如音色,确保语音生成的全局可控性;Semantic Tokens则以wav2vec2.0提取的特征为输入,编码与文本紧密相关的信息,确保语义的强相关性。这种设计不仅解决了传统语音编码中存在的问题,还实现了语音token建模与文本token建模的高度统一,使语音生成更加高效且可控。



基于这一创新,TicVoice7.0展现出卓越的语音克隆能力和情感表现力。它能够在3秒内敏锐捕捉声纹特征,让AI不仅能“说人话”,还能模仿人类的叹息、停顿等细微情感表达。相比上一代语音大模型,TicVoice7.0在音色相似度、情感表现及稳定性上均有显著提升,国际通用MOS评分从3.9提升至4.2,情感表现力更强,听感更自然、悦耳且稳定。


此外,TicVoice7.0在个性化定制方面也表现出色。用户可以通过调整性别、语速、基频等多种属性,精准塑造独特的声音风格。在“至臻Pro-精品发音人”定制方面,用户仅需提供20-200句语料,即可获得播音级专业配音体验,国际通用MOS评分从4.3提升至4.7,达到广播级水平,为影视、游戏等场景提供了专业级的语音生成解决方案。


目前,出门问问已将TicVoice7.0落地于旗下AI配音产品“魔音工坊”,为用户带来更好的服务和体验。该引擎不仅在客服、有声书、情感直播、影视解说等应用场景中表现出色,还通过开源生态与产学研深度协同,为行业发展注入了新动能。

78578
收录于合集
文章来源于网络,如有侵权请联系本站删除
二手好课
更多>>
次卡|瑜伽课转让
小班课
¥4263
年卡|大刊牛文课转让
大刊牛文课
¥1000
年卡|26考研英语课程转让
考研课
¥600
年卡|优路教育注册监理工程师线上课程
注册监理工程师
¥1800
年卡|一级建造师 优路教育 私教班
一级建造师
¥1000
年卡|注册电气工程师基础考试,英之教育,优培班
注册电气工程师
¥2000
年卡|超格网课转让
教师招聘
¥500
次卡|宁波哈喽贝比早教课时托班
早教课
¥8800
次卡|泰安克莱沃(金色雨林)早教课。配合更名。 还余76节课。一口价8890转。
早教课
¥8890
次卡|昆明海伦国际七田阳光早教课100节
早教课
¥9000