近日,2023中国算力大会在宁夏银川落下帷幕。沐曦集成电路(上海)有限公司联合创始人、CTO兼首席硬件架构师彭莉,在由中国信通院和中国互联网协会联合主办的智能计算论坛上,分享了她对后GPT时代算力挑战的深度观察,以及GPU如何破解算力供需瓶颈、推动AI普惠化发展的思考。

沐曦联合创始人、CTO兼首席硬件架构师彭莉发表主题演讲
在题为“后GPT时代的算力需求”的演讲中,彭莉给出了一个关键判断:大模型的商业模式未来将分化成两大阵营——通用计算市场和专用定制化市场。通用计算市场这边,大语言模型会“吞掉”绝大多数NLP任务,技术水平被强行拉到一个基准线上,最终通用大模型可能被几家大厂“垄断”;而专用定制化市场则是另一番景象——开源大模型会呈现出百花齐放的局面,企业可以针对私有数据、敏感数据进行快速定制和领域对齐,大模型的开发和部署能力将变得越来越普及。
她进一步指出,生成式AI和传统AI的区别在于,生成式AI能借助类ChatGPT应用,发挥出显著的技术优势,帮大语言模型开发省下不少成本、提升效率。但与此同时,它对算力的要求也更高、更迫切。大模型训练的一次性成本,最终要靠大规模推理来摊薄,所以盈利的关键难点之一,就是如何把推理成本降下来。
沐曦的思路很清晰:打造高效通用的GPU芯片,以及软硬件一体的生态解决方案。具体来说,通过GPU软件生态的优势、硬件架构的优化,再加上先进封装技术,全面提升GPU算力,同时降低大模型训练和推理的算力成本。从产品路线到生态战略,沐曦都在为满足大模型对算力基础设施的大规模需求做准备,为智能产业的可持续发展打牢算力底座。
