在近日举办的世界人工智能大会上,市北高新展台迎来了喜马拉雅的亮相,带来新一代音频大模型、全新智能创作平台“音剪AI”以及多款智能硬件产品。根据现场反馈,这些展示引发了广泛关注,效果令人惊喜。

值得关注的是,喜马拉雅音频大模型是国内首个通过国家网信办备案的音频生成类大模型。其自主研发的TTS技术已迭代七代,累计产出音频时长突破1000万小时。此次展出的最新版本命名为“Audiobook-A2”,在内容理解、声音生成和演绎控制三大维度上均实现了显著提升。
喜马拉雅珠峰实验室音色产品负责人徐昊在介绍时指出:“传统有声内容创作主要依赖人工全流程操作,步骤繁琐且门槛较高。而在喜马拉雅音频大模型的赋能下,创作者只需一键即可生成多角色、富有情感的高质量演播作品,制作速度提升数十倍。”

同期展示的“音剪AI”是以喜马拉雅音频大模型为底层模型的音频智能创作平台。相比之前版本,本次新增了“智能后期”和“音色分配”两大功能。智能后期可根据文本内容自动识别场景氛围与情绪变化,并智能匹配音效、背景音乐乃至表演提示;音色分配则能依据文本帮助创作者梳理不同角色的性格特征与叙事身份,为旁白及各类角色推荐合适音色,避免前期反复试音筛选。截至目前,“音剪AI”已累计上线超过1万种有声角色音,覆盖多种年龄与角色类型。
上海市北高新集团党委书记、董事长孙中峰在现场表示:“从音剪AI到智能硬件产品,喜马拉雅正在积极构建覆盖多元场景的音频智能服务生态。这种软硬件协同创新的模式,充分展现了音频AI赛道的发展潜力。市北国际科创区将继续深耕科技产业培育,助力科技产业实现高质量发展。”
原标题:《喜马拉雅音频大模型全新升级,市北国际科创区加速培育科技产业》
