资讯
RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%
📋总体概括
社区开发者wilsjo2通过OptiScaler项目将英伟达DLSS 5神经渲染模型从纯FP8迁移至混合FP8/NVFP4格式,并在原生支持NVFP4加速的RTX 50系列GPU上成功运行。然而实测令人失望:完整神经渲染通道耗时仅缩短约1%至2%。在120秒的《博德之门3》测试中,混合模式帧率55.16 FPS,纯FP8为54.57 FPS,差距不到1.5%,且开发者表示该差异尚无法稳定复现,并称Blackwell上的提升「非常微小」。
⚡关键信息
- ▸开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass项目0.7.1版本,首次在RTX 50系列上实现DLSS 5的混合FP8/NVFP4运行
- ▸实测显示神经渲染通道耗时仅缩短约1%至2%,与Tensor Core原生NVFP4加速的理论预期相差甚远
- ▸《博德之门3》120秒测试中,混合模式55.16 FPS对比纯FP8的54.57 FPS,帧率差距不到1.5%
- ▸开发者明确警告该微小差异尚未被证实可稳定复现,且版本0.7.2中NVFP4仅为Blackwell的推荐选项而非默认
- ▸关键点:1%-2%仅指神经渲染通道耗时缩短,而非游戏整体帧率提升,玩家实际收益更小
🔥犀利点评
这本质上是给显卡厂商的技术宣传泼了一盆冷水。NVFP4被英伟达当作Blackwell Tensor Core的核心卖点反复宣讲,结果社区大神硬啃出来只有1%的收益,连误差范围都兜不住。说明瓶颈根本不在算力精度,而在模型结构、显存带宽和工程链路——硬件参数表的漂亮数字,离真实体验还隔着一整条优化深坑。当然,社区魔改本就受限,官方后续能否榨出NVFP4的真实价值,才是真正的试金石。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →