首页 游戏 软件 资讯 排行榜 专题
首页
AI
通义千问Qwen3-TTS两款AI语音模型发布:支持定制与声音复刻

通义千问Qwen3-TTS两款AI语音模型发布:支持定制与声音复刻

热心网友
27
转载
2025-12-24

12月24日消息,阿里通义今日正式发布Qwen3-TTS家族的两款全新模型:音色创造模型Qwen3-TTS-VD-Flash与音色克隆模型Qwen3-TTS-VC-Flash。两款模型的主要特性如下:

免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈

音色创造:Qwen3-TTS-VD-Flash支持用户通过复杂、自然的语言指令输入,实现对音色、韵律、情感乃至人设的精细化调控。它让用户能够全面掌控从“说什么”到“如何说”的整个过程,自由定义心中想要的语音特质。这彻底改变了以往只能克隆现有音色,或是在有限预设音色库中进行选择的局面。
在InstructTTS-Eval评测中,其综合表现显著优于GPT-4o-mini-tts和Mimo-audio-7b-instruct;在角色扮演测试中也超越了Gemini-2.5-pro-preview-tts。

音色克隆:Qwen3-TTS-VC-Flash支持仅需3秒音频即可完成音色克隆,并能基于克隆出的音色,生成涵盖中文、英文、德语、意大利语、葡萄牙语、西班牙语、日语、韩语、法语、俄语等10大主流语言的语音。
在MiniMax TTS Multilingual Test Set上,其平均词错误率(WER)全面低于MiniMax、ElevenLabs及GPT-4o-Audio-Preview。

高表现力:无论是Qwen3-TTS-VD-Flash还是Qwen3-TTS-VC-Flash,都具备高度拟人化的自然音色。它们能够稳定、可靠地输出与文本内容高度契合的语音,并依据文本语义自动调节语气节奏,呈现出自然生动的表达效果。

鲁棒的文本能力:两款模型均拥有强大的文本解析能力,可自动处理复杂文本结构,精准提取关键信息。对于多样化、非规范化的文本格式,都展现出较强的鲁棒性(注:鲁棒性指系统在面临内部结构或外部环境的变化时,维持功能稳定运行的能力)。

Qwen3-TTS-VD-Flash

该模型支持用户通过自然语言描述来生成定制化的音色形象。您只需随意输入有关声学属性、人设描述、背景信息等自由描述,即可轻松创造出自己期望的语音形象。

可控的生成质量:在InstructTTS-Eval评测中,Qwen3-TTS的综合表现显著优于GPT-4o-mini-tts和Mimo-audio-7b-instruct;在角色扮演测试中也超越了Gemini-2.5-pro-preview-tts。

阿里通义 Qwen3-TTS 家族上新两款 AI 模型:声音不仅能复制,还可以定制

Qwen3-TTS-VC-Flash

该模型支持通过自然语音进行3秒级别的音色克隆。基于克隆出的音色,可生成多语种音频,同时对复杂文本和带有环境背景音的“野生”音频都具有较高的处理鲁棒性。

多语种音色克隆:在MiniMax TTS Multilingual Test Set上,Qwen3-TTS在中、英、法、意等语种的内容稳定性方面优于MiniMax、ElevenLabs及GPT-4o-Audio-Preview;其平均词错误率(WER)也位居第一。

阿里通义 Qwen3-TTS 家族上新两款 AI 模型:声音不仅能复制,还可以定制

Qwen3-TTS-Voice-Design API 文档:

https://www.alibabacloud.com/help/zh/model-studio/qwen-tts-voice-design?spm=a2ty_o06.30285417.0.0.56a0c9216Ey6VM

Qwen3-TTS-Voice-Clone API 文档:

https://www.alibabacloud.com/help/zh/model-studio/qwen-tts-voice-cloning?spm=a2ty_o06.30285417.0.0.56a0c921WnHNlN

来源:https://www.ithome.com/0/907/705.htm
免责声明: 游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

相关攻略

Qwen3-TTS上新:阿里通义自研语音模型,可复刻可定制
科技数码
Qwen3-TTS上新:阿里通义自研语音模型,可复刻可定制

IT之家 12 月 24 日消息,阿里通义今日官宣,Qwen3-TTS 家族新推出两款模型,音色创造模型 Qwen3-TTS-VD-Flash 和音色克隆模型 Qwen3-TTS-VC-Flash。

热心网友
12.24
通义千问Qwen3-TTS两款AI语音模型发布:支持定制与声音复刻
AI
通义千问Qwen3-TTS两款AI语音模型发布:支持定制与声音复刻

12 月 24 日消息,阿里通义今日官宣,Qwen3-TTS 家族新推出两款模型,音色创造模型 Qwen3-TTS-VD-Flash 和音色克隆模型 Qwen3-TTS-VC-Flash。附模型主

热心网友
12.24
阿里万相2.6上线,国内首推角色扮演功能
AI
阿里万相2.6上线,国内首推角色扮演功能

12 月 16 日消息,阿里发布新一代万相 2 6 系列模型,该系列模型面向专业影视制作和图像创作场景进行了全面升级,全新的万相 2 6 是国内首个支持角色扮演功能的视频模型。该模型同时支持音画同

热心网友
12.16
阿里通义Qwen3-VL开源4B与8B模型,超越GPT-5 Nano
AI
阿里通义Qwen3-VL开源4B与8B模型,超越GPT-5 Nano

10 月 15 日消息,阿里通义今日官宣 Qwen3-VL 系列再添新成员 ——Dense 架构的 Qwen3-VL-8B、Qwen3-VL-4B 模型开源上线。Qwen3-VL-4B 8B

热心网友
10.16
阿里通义招募AI大牛,将研发下一代大模型
科技数码
阿里通义招募AI大牛,将研发下一代大模型

9月30日消息,据媒体爆料,全球顶尖AI科学家、IEEE Fellow许主洪(Steven Hoi)已加盟阿里通义,转向通义大模型的相关研发工作。许主洪拥有超20年AI产业和学术经验,是新加坡管理大

热心网友
09.30

最新APP

银河传说
银河传说
角色扮演 04-01
仙山小农
仙山小农
模拟经营 04-01
律动轨迹
律动轨迹
休闲益智 04-01
逐鹿
逐鹿
角色扮演 04-01
危境
危境
角色扮演 04-01

热门推荐

消息称三星电子 SF1.0 工艺采用 forksheet 器件结构,目标 2030 年前开发
业界动态
消息称三星电子 SF1.0 工艺采用 forksheet 器件结构,目标 2030 年前开发

三星电子计划在2030年前开发基于 forksheet 结构的 1nm SF1 0 工艺 近日,半导体制造领域传出重要技术进展。据《韩国经济日报》3月31日援引行业内部人士消息,三星电子晶圆代工厂已经制定了一项直至2030年的详细技术路线图。该计划的核心目标是,在2030年之前完成1纳米(1nm)级

热心网友
04.01
OPPO K15 Pro风扇5年质保:问题部件免费换新服务
网络安全
OPPO K15 Pro风扇5年质保:问题部件免费换新服务

4月1日消息,OPPO于今日在线上正式发布了新一代机型K15 Pro。该系列手机最受瞩目的核心卖点在于全系搭载了性能强劲的疾风散热引擎,通过主动散热技术大幅提升了手机在高负载状态下的性能表现。为了从

热心网友
04.01
三星与SK海力士加大在华投资,扩产能破解存储短缺
电脑教程
三星与SK海力士加大在华投资,扩产能破解存储短缺

4月1日消息,为了有效应对全球存储市场的短缺危机,韩国两大芯片巨头三星电子与SK海力士不约而同地选择了加大对中国工厂的投入。据韩国媒体最新披露,这两大巨头已确定在2025年继续扩大在华投资规模。这一

热心网友
04.01
特斯拉前高管孔艳入职小米汽车核心团队消息解读
科技数码
特斯拉前高管孔艳入职小米汽车核心团队消息解读

4月1日消息,4月1日,界面新闻独家获悉,原特斯拉中国区总经理孔艳双已入职小米,将接替原小米汽车总监李晓锐负责汽车销售方面工作。孔艳双于3月初入职,处于工作交接期,目前小米内部并未正式发文通告其正式

热心网友
04.01
笔记本续航短?第三代酷睿 Ultra 轻薄本,彻底终结电量焦虑
业界动态
笔记本续航短?第三代酷睿 Ultra 轻薄本,彻底终结电量焦虑

笔记本电脑电池不耐用?酷睿 Ultra 三代轻薄本彻底解决续航难题 移动办公时,笔记本电脑续航时间短是许多用户的核心痛点。如今,搭载新一代处理器的轻薄本带来了突破性解决方案:华硕无畏 Pro16 2026 酷睿版。这款产品内置英特尔酷睿 Ultra7 356H 处理器,并配备高达 80Wh 的大容量

热心网友
04.01