跳到正文
IT之家 AI·· 24 天前评分68

英伟达 DLSS 5 混合精度 Mod 测试:RTX 50 系列显卡性能仅提升 1% 至 2%

摘要

IT之家 9 月 12 日消息,在英伟达 DLSS 5 神经渲染 DLL 文件流出后,各路民间大神纷纷下场进行调试和优化,还有 Mod 开发者尝试通过降低模型推理成本以提升游戏性能。 根据 X 用户 SwurvGaming 分享的情报,有 Mod 开发者将 FP8 与 NVFP4 混合精度应用于 DLSS 5 神经渲染模型,并在 RTX 50 系列显卡上运行。 不过,该方案在 4K 分辨率下仅将神经渲染阶段耗时降低约 1% 至 2%,开发者称其在 Blackwell 架构上的改进“非常有限”。 由于英伟达 Blackwell 架构第五代 Tensor Core 原生支持 NVFP4,开发者尝试将部分 DLSS 5 计算从 FP8 切换至 NVFP4,以降低推理开销。 需要注意的是,1% 至 2% 的数据仅代表 DLSS 5 神经渲染阶段耗时的下降,并非整款游戏的帧率提升。 此次实验由 OptiScaler-DLSSNR-PreS...

推荐理由

来自IT之家 AI的《英伟达 DLSS 5 混合精度 Mod 测试:RTX 50 系列显卡性能仅提升 1% 至 2%》。重点看模型能力与工程。摘要提到:IT之家 9 月 12 日消息,在英伟达 DLSS 5 神经渲染 DLL 文件流出后,各路民间大神纷纷下场进行调试和优化,还有 Mod 开发者尝试通过降低模型推理成本以提升游戏性能。 根据 X 用户 SwurvGaming 分享的情报,有 Mod 开发者将 FP8 与 NVFP4 混合精度应用于 DLSS 5 神经渲染模型,并在 RTX 50 系列显卡上运行。 不过,该方案在 4K 分辨率下仅将神经渲染阶段耗时降低约 1% 至 2%,开发者称其在 Blackwell 架构上的改进“非常有限”。 由于英伟达 Blackwell 架构第五代 Tensor Core 原生支持 NVFP4,开发者尝试将部分 DLSS 5 计算从 FP8 切换至 NVFP4,以降低推理开销。 需要注意的是,1% 至 2% 的数据仅代表 DLSS 5 神经渲染阶段耗时的下降,并非整款游戏的帧率提升。 此次实验由 OptiScaler-DLSSNR-PreS...

本站只提供摘要与原文入口。完整内容请阅读原文。

来源:IT之家 AI · ithome.com