阿里通义语音双模型上线:一句话即可生成高质量语音
3月2日,阿里通义实验室语音团队正式推出两款支持自由风格指令生成的模型——Fun-CosyVoice3.5与Fun-AudioGen-VD。
免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈
据介绍,这两款模型实现了对语音表达和音频场景的精准控制。用户仅需通过自然语言指令,即可直接生成所需的语音效果,无论是细腻的情绪表达,还是从零开始设计音色与场景,都能轻松实现。
其中,Fun-CosyVoice3.5专注于多语种复刻与精细化表达控制。用户可以直接用自然语言描述表达方式,例如“语气再坚定一些”“稍微压低音调,语速放慢一点”“带一点情绪起伏”……模型能准确理解并生成对应的语音表现。此外,针对生僻字、复杂语句等容易读错的场景,Fun-CosyVoice3.5进行了专项优化,将生僻字读错率从15.2%降至5.3%,

而Fun-AudioGen-VD则主打音色设计与场景化音频生成。它支持根据自然语言描述,生成目标音色、情绪表达和完整听觉场景。不仅如此,Fun-AudioGen-VD不仅能生成语音,还能生成语音所处的“世界”,为用户打造沉浸式的听觉体验。

相关攻略
IT之家 4 月 6 日消息,荣耀全场景软件主理人 @荣耀席迎军 今日再度分享了 MagicBook 全新 AI UI。他透露,他的电脑在升级最新版本后,性能大幅度提升,而且可玩性更高。有网友询问了
IT之家 4 月 3 日消息,科技媒体 Android Authority 昨日发布博文,报道称在安卓 17 Beta 3 更新中,发现谷歌正在酝酿“通知规则”功能,用户可以针对特定应用、联系人设定
IT之家 3 月 17 日消息,科技媒体 Android Authority 今天发布博文,报道称三星承认 Galaxy S26 Ultra 旗舰手机的“防窥屏”技术存在瑕疵,在特定视角和最高亮度下
IT之家 3 月 17 日消息,小度上周宣布接入 OpenClaw 龙虾生态,小度智能家居 Skills 已登陆 ClawHub。IT之家注意到,小度去年就已完成智能家居控制能力的 MCP 化升级,
IT之家 3 月 10 日消息,AI 理想同学的最新账号今日宣布,理想 AI 眼镜 Livis 再进化,带来了佩戴检测 + 一气呵成两大开关、连续语音抓拍等功能。IT之家附理想 AI 眼镜 Livi
热门专题
热门推荐
领克首款GT概念跑车亮相北京车展,由中欧团队联合打造。新车采用经典GT比例与低趴宽体设计,配备液态金属蓝涂装与2+2座舱,设有高性能模式按键可激活空气动力学套件。车辆采用后驱布局与AI智能运动控制系统,百公里加速约2秒,设计融合瑞典极简美学并参考全球用户反馈。
英伟达推出12GB显存版RTX5070移动GPU,与8GB版同步上市。两者均基于Blackwell架构,核心规格相同,仅显存容量不同。此举旨在缓解GDDR7芯片供应压力,为OEM提供灵活配置,加速笔记本产品布局,更大显存可更好满足游戏与AI应用需求。
微星将于5月15日推出两款26 5英寸雾面WOLED显示器MAG276QRY28和276QRDY54,售价分别为2499元和6299元。均采用第四代WOLED面板,具备QHD分辨率、VESADisplayHDRTrueBlack500认证、1500尼特峰值亮度及99 5%DCI-P3色域覆盖。276QRY28刷新率为280Hz,高阶款276QRDY54支持4
中芯国际2026年第一季度营收176 17亿元,同比增长8 1%;净利润13 61亿元,同比增长0 4%。公司预计第二季度收入环比增长14%至16%,毛利率指引上调至20%至22%。这反映出公司在行业复苏中展现出财务韧性,并通过运营优化增强了短期增长势头。
手机修图、相机降噪、视频去雾……这些我们日常使用的图像处理功能,其背后都离不开人工智能(AI)技术的驱动。通常,AI模型的训练逻辑是:向模型展示大量“低质图像”与“优质图像”的配对数据,让它学习如何将前者转化为后者。然而,天津大学计算机视觉团队近期发表的一项研究(arXiv:2604 08172)揭





