快科技9月11日消息,据报道,DLSS 5社区开发者近日成功将英伟达DLSS 5的神经渲染模型从纯FP8格式迁移至混合FP8/NVFP4格式,并在RTX 50系列GPU上运行成功。
这一实验由开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass项目版本0.7.1发布。然而实测结果令人大失所望,完整神经渲染通道的耗时仅缩短了约1%至2%。

RTX 50系列搭载的第五代Tensor Core原生支持NVFP4加速,理论上将部分计算从FP8迁移至NVFP4可显著提升推理速度。但实际情况是,开发者本人将Blackwell上的提升描述为“非常微小”。
在版本0.7.2中,开发者将NVFP4混合模式设为Blackwell GPU的推荐选项。一次120秒的《博德之门3》测试中,混合模式渲染帧率为55.16 FPS,而纯FP8模式为54.57 FPS,差距不到1.5%,且开发者明确警告这一微小差异尚未被证实可稳定复现。
更关键的是,这1%至2%指的是DLSS 5神经渲染通道耗时的缩短,而非游戏整体性能的提升。不支持NVFP4的模型形状仍会自动回退到FP8处理,混合模式的实际收益进一步被稀释。
NVFP4是英伟达Blackwell架构专属的4-bit浮点格式,相比FP8可显著降低内存占用和计算量。但将一个基于FP8训练的模型直接转换为NVFP4,并非简单切换指令即可完成,需要进行针对性的量化与重新训练才能发挥NVFP4的潜力。
英伟达此前也向媒体确认,DLSS 5目前尚未采用NVFP4量化。
目前来看,这次社区实验的结论很明确:简单地将现有FP8模型转向NVFP4,并不能带来预期的性能飞跃。DLSS 5要真正吃到NVFP4红利,还需要英伟达官方的模型重构与优化。

【本文结束】如需转载请务必注明出处:快科技
责任编辑:红茶


