11月10日,在乌镇互联网大会的互联网企业家论坛上,阿里巴巴集团CEO吴泳铭发布了一则重磅消息——阿里即将开源720亿参数的大模型。这一动作备受行业关注,一旦正式落地,它有望成为国内参数规模最大的开源大模型之一。
事实上,阿里在大模型开源领域早已持续布局。今年8月,阿里推出并开源了Qwen-7B和Qwen-7B-Chat,也就是通义千问70亿参数的通用模型与对话模型。到了9月,又进一步开源了140亿参数的Qwen-14B及其对话版本,并且全部支持免费商用。如今参数规模直接提升至720亿,阿里在开源大模型上的推进速度和力度都相当明显。
吴泳铭在现场还特别强调了一个重要判断:以大模型为代表的人工智能AI技术,其发展速度将远超外界想象。它所带来的影响,不仅会深入改变生产力和生产关系,也会加速推动数字世界与现实世界的融合。结合过去一年AI行业的快速迭代来看,这样的判断并不夸张,反而相当贴近当下趋势。
那么,阿里在AI时代希望扮演怎样的角色?吴泳铭给出的定位非常明确:阿里巴巴要成为一家服务全社会AI创新的、开放的科技平台企业。从具体路径来看,阿里将继续围绕平台能力建设更完善的基础设施底座,持续加大开放与开源力度,并与广大开发者、企业用户共同推动AI生态建设和产业发展。
事实上,阿里集团主席蔡崇信此前也曾公开表示,希望阿里成为AI时代“最开放的云”之一,让开发AI、应用AI变得更加简单、更具性价比。从当前的开源策略和技术布局来看,这一承诺正在被逐步落实,也进一步强化了阿里云与阿里大模型生态的市场关注度。
一个值得持续关注的细节是:720亿参数的开源模型究竟意味着什么?通常来说,参数规模越大,大模型的语言理解、知识表达以及复杂任务处理能力往往越强,但与此同时,对算力资源、模型部署和使用成本的要求也会更高。阿里选择在这一时间点开源如此大规模的模型,显然不只是展示技术实力,更像是在为整个AI行业生态铺设基础,帮助降低大模型应用门槛。毕竟,想要推动人工智能生态繁荣,前提之一就是核心工具足够开放、易用且可持续发展。
