资讯

英伟达 DLSS 5 混合精度 Mod 测试:RTX 50 系列显卡性能仅提升 1% 至 2%

IT之家·2026/9/12 02:28:34🔗 原文

📋总体概括

英伟达DLSS 5神经渲染DLL流出后,Mod开发者尝试通过混合精度优化降低推理成本。X用户SwurvGaming分享的测试显示,开发者借助Blackwell架构第五代Tensor Core原生支持NVFP4的特性,将部分计算从FP8切换至NVFP4,通过OptiScaler-DLSSNR-PreSR-Multipass项目在RTX 50系列显卡上实测,但4K分辨率下神经渲染阶段耗时仅下降约1%至2%,且该数据不等于整帧率提升,开发者承认在Blackwell架构上改进非常有限。

关键信息

  • Mod开发者将FP8与NVFP4混合精度应用于DLSS 5神经渲染模型,并在RTX 50系列显卡上运行测试
  • 测试基于Blackwell架构第五代Tensor Core原生支持NVFP4的特性,尝试切换计算精度以降低推理开销
  • 4K分辨率下神经渲染阶段耗时仅降低约1%至2%,开发者称改进非常有限
  • 1%至2%仅为神经渲染阶段耗时降幅,并非游戏整体帧率提升
  • 实验由OptiScaler-DLSSNR-PreSR-Multipass项目引入,基于流出的DLSS 5 DLL文件

🔥犀利点评

民间大神再努力,也难敌架构层面的硬约束:Blackwell对NVFP4的原生支持看似是降本捷径,实测却几乎颗粒无收,说明DLSS 5的推理瓶颈根本不在精度位数上。更关键的是,这点改善还只停留在渲染阶段,换算到实际帧率更是微乎其微。流出的DLL能玩出的花样,天花板已经肉眼可见,真正的性能钥匙仍握在英伟达自己手里。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文