7月21日,英伟达(NVDA.US)官方发布了一则重要消息:在SIGGRAPH大会上,NVIDIA AI 研究与工程团队负责人登台亮相,集中展示了神经渲染、世界模型和仿真领域的最新突破。这些技术正在悄然重塑数字世界被创建与使用的底层逻辑,而其应用场景——从创意工具、工业设计,到机器人和自主系统——已十分明确。
开场视频中,NVIDIA创始人兼CEO黄仁勋表示:“创作者和设计师需要足够强大的工具来拓展想象力,也需要足够灵活的工具来自由地雕琢想法,更要足够精准以实现他们的愿景。”他进一步强调,无论应用于游戏、电影、机器人,还是工厂的数字孪生,终极目标始终如一:打造一个与现实物理世界具有同等保真度和真实感的虚拟世界。这番表述看似宏大,但背后的技术细节才是真正的亮点。
应用深度学习研究主管Edward Liu率先登台,展示了3D引导神经网络渲染技术。他详细阐述了NVIDIA在神经渲染领域的最新成果,以及这些技术如何直面三大关键研究挑战:保留艺术创作意图、确保帧间时间稳定性,以及实现4K内容的实时渲染。这三个挑战中的任何一个都足以耗费数年攻关,而NVIDIA的解决方案是让神经网络学会“理解”艺术家意图,同时保持画面稳定不闪烁,并在4K分辨率下流畅运行。这绝非简单的“修修补补”。
随后,杰出工程师Neil Ashton带来了AI物理领域的创新。他分享的内容覆盖天气预报、汽车空气动力学、散热设计等多个方向。有趣的是,Ashton透露了一个关键细节:NVIDIA研究中心及其合作伙伴开发的最新模型架构,能够将模型Checkpoint压缩至几百MB。这种百万倍级的压缩意味着什么?意味着可在不到一秒内完成符合物理规律的精准可视化。过去需要超级计算机运行数天的模拟,如今压缩后几乎能实时输出结果,在实际工程中意义非凡。
最后,NVIDIA Cosmos实验室副总裁Ming-Yu Liu介绍了Cosmos平台。这是一个专为加速物理AI系统开发而打造的世界基础模型平台。Cosmos包含一系列不同规模的开放模型,开发者可根据具体部署场景灵活选用。今天发布的重点是最新版本——Cosmos 3 Edge,一个拥有40亿参数的模型,关键特性是可直接在设备上实时运行。这意味着边缘设备也能拥有世界模型级别的AI能力,而不再必须依赖云端。
总体来看,这次SIGGRAPH上的发布,与其说是技术展示,不如说是一次对“数字世界与现实世界边界”的重新定义。从神经渲染到物理AI,再到世界模型,英伟达正将一个个看似遥远的技术堆叠成可落地的工具链。而真正令人振奋的,是这些技术背后的逻辑:它们不再只是实验室里的论文,而是在为创意工具、工业设计、机器人和自主系统提供实实在在的“感知”与“推理”能力。
