前言:从大模型到边缘部署,AI的下一站
随着ChatGPT的火爆,AIGC(生成式人工智能)这一新兴概念也备受瞩目。目前,AIGC已在新闻报道、广告创意、音乐创作等领域广泛应用,它不仅能模仿人类的写作风格,甚至能创造出全新的作品。然而,AIGC的潜力远不止于此——通过海量数据训练的大规模神经网络模型(大模型),随着模型层数和参数的不断增加,其“思维方式”越来越接近人脑,在金融、制造、医疗等行业的应用也日益广泛。
训练大模型需要巨大的计算资源来执行复杂的矩阵运算等任务,因此必须使用高性能计算设备,并配合高效的算法与架构设计来优化训练效率。为了满足差异化的算力需求,通常需要搭建具备万亿级参数计算能力的“智算中心”。现阶段的智算中心多采用云模式,通过共享、共融的方式集结现有算力,并利用万卡平台及高效网络交互机制构建大模型训练与推理平台。
然而,训练和部署大模型的代价极高,在实际工业应用中必须考虑成本。因此,模型轻量化成为必不可少的一环。一种有效的轻量化方法是模型压缩,即通过剪枝、量化和蒸馏等技术将通用大模型压缩为轻量化模型,使其能在算力较小的设备上进行训练和推理,从而大幅降低部署成本。
尽管轻量化技术能缓解模型规模增长的压力,但大模型的规模仍在持续增长,这也刺激了各大芯片厂商在AI芯片上的研发投入。特别是受众更广、性价比更高的AI系统化模块(SOM),其算力每年以数倍级提升。SOM算力的提升使得处理轻量化后的小模型成为可能,有助于实现从基础大模型 → 行业微调模型(通用2B) → 场景结合模型(专用2B)的转换。这些小巧的AI系统化模块,正是对空间、能耗、环境、安全、响应要求苛刻的边缘端设备的首选。在此过程中,边缘端设备扮演着关键角色,推动了AI部署从云端向边缘的迁移,未来将获得更大的市场重视。
聚焦产品:研扬科技边缘AI解决方案
研扬科技致力于为客户提供高质量、高性能的边缘端计算产品,是业界领先的边缘AI解决方案设计制造商。作为英伟达Elite member of the NVIDIA Partner Network(合作伙伴网络精英成员),研扬推出了基于NVIDIA Jetson AGX Orin系统化模块(SOM)的两款紧凑型无风扇边缘盒子——ARES-240AI和ARES-241AI。这两款产品将NVIDIA Jetson AGX Orin的超高性能与全新打造的强化耐用机壳相结合,提供32GB / 64GB版本可选,拥有高达275 TOPS的服务器级算力。以往需要专业显卡支持才能运行的应用(如自动驾驶),现在凭借ARES-240AI和ARES-241AI的实时物体侦测、数据加速传输和强大的严苛环境耐受度,可将整个操作移至边缘。这两款边缘盒子是重新定义自主边缘应用进行AI深度学习的理想载体。通过NVIDIA Jetson AGX Orin与其他NVIDIA Jetson模组、开发者套件获得同一NVIDIA Jetson软件栈的支持,只需一次开发,即可在任意位置部署,从而加快产品上市速度。
核心亮点一:超强AI算力与性能
ARES-240AI和ARES-241AI搭载的NVIDIA Jetson AGX Orin,拥有12核ARM v8.2 64位CPU和配备64个Tensor Core的2048核NVIDIA Ampere架构GPU,最高可达275 TOPS的算力,相比Jetson AGX Xa vier提供了高达8倍的AI性能提升。两款产品还配备了64GB内存,在W4A16量化中可完美支持Llama-70B模型。借助NVIDIA TAO工具套件,在行人检测、3D姿态估计、DashCamNet、车牌识别等模型架构中,能以更小的体积提供与英伟达专业显卡T4相似甚至更高的推理性能。这有助于机器人和智能交通场景中实现实时目标检测与多传感器的结合,并大大增强定位和目标确认精度。
