17173 > 游戏资讯 > 科技新闻 > 正文

RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%

2026-09-11 10:01:37 神评论
17173 新闻导语

RTX 50用户空欢喜!大神将DLSS 5强行切换NVFP4实测:神经渲染速度仅快1%,游戏帧率几乎无提升,博德之门3测试差1.5%。真相在此!

据报道,DLSS 5社区开发者近日成功将英伟达DLSS 5的神经渲染模型从纯FP8格式迁移至混合FP8/NVFP4格式,并在RTX 50系列GPU上运行成功。

这一实验由开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass项目版本0.7.1发布。然而实测结果令人大失所望,完整神经渲染通道的耗时仅缩短了约1%至2%。

RTX 50系列搭载的第五代Tensor Core原生支持NVFP4加速,理论上将部分计算从FP8迁移至NVFP4可显著提升推理速度。但实际情况是,开发者本人将Blackwell上的提升描述为“非常微小”。

在版本0.7.2中,开发者将NVFP4混合模式设为Blackwell GPU的推荐选项。一次120秒的《博德之门3》测试中,混合模式渲染帧率为55.16 FPS,而纯FP8模式为54.57 FPS,差距不到1.5%,且开发者明确警告这一微小差异尚未被证实可稳定复现。

更关键的是,这1%至2%指的是DLSS 5神经渲染通道耗时的缩短,而非游戏整体性能的提升。不支持NVFP4的模型形状仍会自动回退到FP8处理,混合模式的实际收益进一步被稀释。

NVFP4是英伟达Blackwell架构专属的4-bit浮点格式,相比FP8可显著降低内存占用和计算量。但将一个基于FP8训练的模型直接转换为NVFP4,并非简单切换指令即可完成,需要进行针对性的量化与重新训练才能发挥NVFP4的潜力。

英伟达此前也向媒体确认,DLSS 5目前尚未采用NVFP4量化。

目前来看,这次社区实验的结论很明确:简单地将现有FP8模型转向NVFP4,并不能带来预期的性能飞跃。DLSS 5要真正吃到NVFP4红利,还需要英伟达官方的模型重构与优化。

【来源:快科技】
我想了解这个游戏:
官网 专区 下载 礼包
关于RTX 50,DLSS 5,NVFP4,性能,FP8,Tensor Core,Blackwell,博德之门3,神经渲染,英伟达的新闻
17173想了解一下大家怎么看17173的,以便提供更好的阅读体验,所以请各位路过的大佬们花一分钟时间看看这个问卷吧 一键参与