7月22日消息,NVIDIA在SIGGRAPH 2026大会上,通过一场长达一小时的演讲,将接近一半的时间(约22分钟)用于深入讲解DLSS 5。这并非简单的技术展示,而是系统性地回应了围绕该技术的诸多争议,核心问题只有一个:开发者能否真正掌握AI渲染画面的控制权?
此事要追溯到今年春季。DLSS 5刚发布时便引发了不小争议。玩家和开发者担心,它是否会像“AI美颜滤镜”一样,不加区分地对精心设计的画面和氛围进行“优化”,反而破坏了原本的艺术效果。NVIDIA应用深度学习研究总监Edward Liu在演讲中虽未直接提及这场风波,但长达22分钟的演示,每一个细节都在回应这些担忧。

Liu将DLSS 5面临的核心挑战总结为:如何在“呈现更真实的效果”与“忠实于原始内容”之间取得平衡。他强调,“创作者意图”(Creator Intent)始终是不可逾越的红线。DLSS 5的处理逻辑是以引擎渲染的原始画面为基准,逐像素进行对应,而这些像素本身已承载着创作者的意图。

一个形象的比喻是:将同一张图片交给十个不同的生成式AI模型,会得到十个截然不同的结果。而DLSS 5面临的挑战远超于此,因为所有调整都必须在实时渲染中完成。玩家最终看到的画面就是DLSS 5输出的结果,必须精准无误,不存在任何容错空间。
为此,NVIDIA在训练模型时,将“尊重创作者意图”置于最高优先级。模型需要识别画面中哪些元素必须保留。例如,角色脸上的疤痕不能被消除,但可以处理得更加真实自然。
DLSS 5需锁定的关键元素
在演讲中,NVIDIA展示了DLSS 5需要锁定并保留的关键元素,包括角色身份、对象语义、姿态、光照语义、运动以及艺术方向。这些维度构成了创作者意图的骨架,AI模型在增强画面时绝不允许超越这些边界。

为了在游戏帧率下实现实时4K推理,NVIDIA采用了一种小型紧凑的单步扩散模型。该模型在保证画面质量的同时,将延迟控制在可接受范围内,这是整个技术方案能够落地的关键所在。

接下来是这场演示的重头戏——开发者对DLSS 5的全面控制能力。正如今年3月GTC所预告的,开发者现在可以为自己的游戏定制DLSS 5的行为,而不再被动接受一个“黑盒”。
首先,是AI模型选择。开发者可以从三款不同的AI模型(A、B、C)中挑选。每款模型的训练数据集不同,因此画面风格也各有特色。更重要的是,这一选择无需全局生效,可以根据具体场景切换。例如,在室内昏暗场景使用一种模型,在室外阳光明媚的场景使用另一种,使开发者能够在不同环境下找到最合适的“配方”。
三款AI模型(A/B/C)在80%结构强度下的效果对比
其次,是全局强度控制。开发者可以针对每个场景调节两个滑块:
结构强度,主要影响光照、阴影和表面纹理的表现;色调强度,则控制色彩与亮度的调整幅度。这两个滑块作用于整幅画面,也可以完全关闭,从而让AI完全“不干预”。

对于角色画面,DLSS 5提供了独立的控制维度。系统能够自动检测画面中的人物(自动遮罩),开发者可以单独设定AI模型对角色外观的干预程度,甚至可以仅对角色应用DLSS 5效果,而背景保持原始渲染状态。

更为灵活的是开发者自定义遮罩功能。开发者可以为特定物体或物体组创建遮罩,精确控制DLSS 5的作用范围和强度,也可以将某些物体完全排除在AI处理之外。例如,开发者可以让整个场景保持引擎渲染的原貌,仅对天空进行AI增强。这种对象级别的控制粒度,在以往的DLSS版本中是无法想象的。
NVIDIA强调,SIGGRAPH 2026上展示的这些设置仅仅是开始,后续还将加入更多控制选项。不过,这些功能是否会在DLSS 5于2026年秋季正式上线时全部可用,NVIDIA并未给出明确的时间表。从现有信息来看,开发者对AI画面的控制权,正被提升至一个前所未有的高度。
