RTX 40 跑 DLSS 5:老黄说损耗 15%,为啥 Modder 跑出来是 39%?
RTX 40 跑 DLSS 5:老黄说损耗 15%,为啥 Modder 跑出来是 39%? 老黄一直声称,DLSS 5 跑在 RTX 40 上"性能损耗可低至 15%"。这话听上去很美——但本周 Modder 圈把《NBA 2K27》里泄露的 DLSS 5 文件扒出来、改吧改吧、扔到 RTX 40
💡 你将学到
RTX 40 跑 DLSS 5:老黄说损耗 15%,为啥 Modder 跑出来是 39%? 老黄一直声称,DLSS 5 跑在 RTX 40 上"性能损耗可低至 15%"。这话听上去很美——但本周 Modder 圈把《NBA 2K27》里泄露的 DLSS 5 文件扒出来、改吧改吧、扔到 RTX 40
📜 目录
RTX 40 跑 DLSS 5:老黄说损耗 15%,为啥 Modder 跑出来是 39%?
老黄一直声称,DLSS 5 跑在 RTX 40 上"性能损耗可低至 15%"。这话听上去很美——但本周 Modder 圈把《NBA 2K27》里泄露的 DLSS 5 文件扒出来、改吧改吧、扔到 RTX 4090 上跑了一下,Tom's Hardware 和 TweakTown 测出来的帧数掉幅是 39%(按帧率下降幅度算),折算成"目标帧率损失比例"是 58%。同一组数据,两个口径,差了一倍多。
那问题来了——老黄到底在说谎?还是 Modder 实测的版本跟英伟达未来要发的不一样?
这两个数字算的是同一回事(算式区别)
先把算术讲清楚,不然后面没法聊。
中国大陆媒体(包括快科技、网易、搜狐)多数按"原始帧率下降幅度"报:130 FPS - 82 FPS = 48 FPS,48 除以 130 ≈ 37%。TweakTown 和 Tom's Hardware 按"目标帧率损失"算:48 除以 82 ≈ 58%。两个数字都是真的,看你怎么定义"损耗"。我用中国大陆通用的口径,写在头条版里的"掉了约 4 成"——按 37% 损耗算的。
但这跟"15%"还差着 22 个百分点。这 22 个点不是"算式不同"能解释的——是两个版本。
老黄的 15%:是英伟达未来 Ada 适配完成后的预期值
英伟达官方那段话是这么说的:"我们当前的首要任务是通过模型更新来优化 RTX 50 系列的性能,预计今年秋季晚些时候推出。在 RTX 50 系列性能充分调优之后,我们将着手把官方支持扩展到 RTX 40 系列。"
注意几个关键词:模型更新、调优、预期。意思是:
- 现在 RTX 40 上跑的 DLSS 5 是 Blackwell 优化版本——专给 RTX 50 第五代 Tensor Core(NVIDIA 自家 AI 计算单元)写的;
- Ada 架构(RTX 40 用的)只有第四代 Tensor Core——硬件算力差一档;
- 英伟达要做的是重新编译一份给 Ada 跑的模型——不是简单开关,是底层 CUDA(NVIDIA 的 GPU 编程接口)二进制(机器码)重写。
这个"重写版",才是英伟达敢喊"15% 损耗"的目标。Modder 圈现在跑的版本,是英伟达从未打算给 RTX 40 用的 Blackwell 版本被硬塞过来——等于是让上一代硬件跑这一代软件,掉 4 成帧数算客气了。
Modder 的 39%:是半成品版本,没调优、也没优化空间
Uncle Burrito 干的活儿,技术上不算复杂:他把 DLSS 5 动态链接库里(就是那个 .dll 文件)原本给 Blackwell 编译的 CUDA 二进制替换成了 Ada 兼容版本,让 DLSS 5 神经渲染(NVIDIA 用神经网络做实时画面重建的技术)能跑在 RTX 40 上。
这一改,DLSS 5 的核心功能(神经渲染、帧生成)能用了,但代价是:
- 推理路径没优化——Blackwell 的 Tensor Core 跑 FP8(一种 8 位浮点精度,AI 模型推理常用)速度快、显存吃得少;Ada 跑 FP8 没有硬件级加速,得靠通用算力硬扛,帧数自然砍;
- 显存带宽是瓶颈——RTX 4090 的显存带宽(GDDR6X 跑在 21 Gbps)是 RTX 5090(GDDR7 跑在 28 Gbps)的 75% 左右,DLSS 5 的中间张量(神经网络在计算过程中临时存放的数据)大,这一关就过不去;
- 没时间做模型裁剪——Modder 圈是"能跑就行",没人花三个月帮英伟达做 Ada 适配。
TweakTown 测出的 82 FPS 已经是 4K 分辨率 + DLSS 5 神经渲染的结果——画质全开,帧数砍 4 成。如果 Modder 圈愿意花时间做 Ada 优化(重写算子、调整张量布局、牺牲一部分画质),再砍个 10-15 个百分点的损耗不是不可能——但这条路径没人走,因为英伟达官方适配版马上要来了。
民间版本会继续涨,但 RTX 40 用户不想等
最戏剧性的不是 15% vs 39% 这个温差——是官方版到底什么时候来。英伟达说"今年秋季晚些时候",到底是 10 月还是 12 月,没人知道。
对 RTX 40 用户来说,这两个月是真空期:
- 等英伟达 → 拿到稳定版本,但时间表模糊;
- 跑 Modder 版本 → 今晚就能用,但每次英伟达更新驱动都得等 Modder 适配(这次 DLSS-G 310.9 封锁就是这么来的);
- 升级 RTX 50 → 解决问题,但 RTX 5090 现在溢价 41%,MSRP(建议零售价)早就是梦。
老黄这次的"15% 损耗"不是吹牛——是给未来画饼。问题是 RTX 40 用户吃饼要等两个月,这两个月的体验谁来负责?民间 Modder 已经动手了。
你手头的 RTX 4090,会陪英伟达调优完吗?还是今晚就跑 MOD 先爽再说?
本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。
