RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%

快科技
 来自河南

快科技9月11日消息,据报道,DLSS 5社区开发者近日成功将英伟达DLSS 5的神经渲染模型从纯FP8格式迁移至混合FP8/NVFP4格式,并在RTX 50系列GPU上运行成功。

这一实验由开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass项目版本0.7.1发布。然而实测结果令人大失所望,完整神经渲染通道的耗时仅缩短了约1%至2%。

RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%

RTX 50系列搭载的第五代Tensor Core原生支持NVFP4加速,理论上将部分计算从FP8迁移至NVFP4可显著提升推理速度。但实际情况是,开发者本人将Blackwell上的提升描述为“非常微小”。

在版本0.7.2中,开发者将NVFP4混合模式设为Blackwell GPU的推荐选项。一次120秒的《博德之门3》测试中,混合模式渲染帧率为55.16 FPS,而纯FP8模式为54.57 FPS,差距不到1.5%,且开发者明确警告这一微小差异尚未被证实可稳定复现。

更关键的是,这1%至2%指的是DLSS 5神经渲染通道耗时的缩短,而非游戏整体性能的提升。不支持NVFP4的模型形状仍会自动回退到FP8处理,混合模式的实际收益进一步被稀释。

NVFP4是英伟达Blackwell架构专属的4-bit浮点格式,相比FP8可显著降低内存占用和计算量。但将一个基于FP8训练的模型直接转换为NVFP4,并非简单切换指令即可完成,需要进行针对性的量化与重新训练才能发挥NVFP4的潜力。

英伟达此前也向媒体确认,DLSS 5目前尚未采用NVFP4量化。

目前来看,这次社区实验的结论很明确:简单地将现有FP8模型转向NVFP4,并不能带来预期的性能飞跃。DLSS 5要真正吃到NVFP4红利,还需要英伟达官方的模型重构与优化。

RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%

【本文结束】如需转载请务必注明出处:快科技

责任编辑:红茶

“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。

Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”

热点新闻