显存优化! NVIDIA DLSS 4让游戏更流畅,Transformer模型显存减少20%
英伟达DLSS 4 SDK正式上线,通过优化Transformer模型显存使用,减少20%,显著降低显卡负担。此举使Transformer模型显存占用仅比传统CNN模型多40%,缓解高分辨率游戏显存压力,提升游戏流畅度。
英伟达刚刚发布了DLSS 4 3.0版本, 这个版本的更新直接让Transformer模型的显存占用减少了百分之二十。对于拥有12GB甚至8GB显存显卡的玩家来说, 他们终于不需要被迫降低分辨率了。这项优化措施到来的速度, 其实比大多数人的预期都要快一些。
显存占用变化数据
英伟达在DLSS 4 3.0这个版本里面, 是对那些用于Transformer推理引擎的部分进行了底层层面的重新构建和调整, 经过这一番改动之后, 模型在执行任务时所出现的显存使用量的最高峰值, 相比起之前的旧版本来算, 是下降了大概百分之二十左右的一个幅度, 回顾一下以前的情况的话就可以知道, 这个模型当时在它自己运行的过程中所实际占用的那种类型的内存空间, 几乎就是传统的那种叫做CNN的方案所占用数量的两倍那么大, 但是现在通过更新优化之后呢, 两者之间所存在的明显差距已经是大幅度地缩小了, 如今的情况是新的这个方案比起旧的那个方案来, 仅仅是高出百分之四十左右的一个水平而已。
具体说, 数值是 4K 全特效的情况下, 显存占用的大小, 从大概的 8.6GB 降到了 6.9GB 这个范围里, 省下来的空间直接让运行高帧率的时候不再触发 因为显存溢出而发出的警告消息了这一下系统稳定的程度就明显变好了许多。
高负载游戏实测表现
根据VideoCardz和IT之家的测试结果, 在对《黑神话: 悟空》以及《赛博朋克2077》这两款高负载游戏进行测试时, 如果在开启DLSS 4以后, 帧率的水平与优化之前的状态相比, 基本上是一致的, 平均的浮动幅度不超过2帧。
从画质的那些层面来瞧一瞧, Transformer这个模型, 它在远景的纹理是怎么进行重建的这个问题上, 以及在边缘那里怎么做到抗锯齿的这个任务上, 它依旧保持着对CNN这种方案的领先优势, 是牢牢保持着的, 而本次做的这个优化动作, 压根就没有做出那种牺牲画面的惨痛代价去换取那个叫做显存节省的事情。
驱动推送与硬件兼容
英伟达这里已经确认过了, DLSS 4 3.0这个技术, 是要随着下个月那个GeForce Game Ready驱动更新来推送的, 首批适配的是RTX 50系列还有RTX 40系列的所有型号。
对于RTX 30系列的用户来说, 在更新驱动之后, 也能够获得一定量的显存收益, 但是这个提升的幅度大概是在百分之8到百分之12这个区间里面。这样的效果远远不能够和RTX 40系列以及未来的RTX 50系列所具备的那些经过完整优化处理之后的良好性能表现相提并论。
中小显存玩家的实际收益
这轮更新的核心受益群体, 是属于那一些拥有8GB显存以及拥有12GB显存显卡的用户。在这之前, 玩家在开启1440p分辨率并保持高画质的时候, 经常弹出关于显存不足的提示。而现在的话, 用户的显存余量变得比较充足, 因此可以稳定地跑满目标帧率。
有不少玩家在游戏社区里表示, 当他们在《艾尔登法环》的DLC里开启DLSS 4之后, 12GB显存的RTX 4070这张显卡, 帧数会从之前掉到大约70帧的情况, 回升并稳定在超过110帧的水平, 这种体验上的差距是非常直接的, 大家能明显感觉到。
竞品与后续规划
根据行业方面的消息, 在短期内, AMD这家公司和Intel这家公司, 都还没有公布能够对标的, 用于AI渲染的显存压缩方案, 所以DLSS 4这个技术, 在推理效率这方面, 依然是保持着一代的领先地位, 而英伟达内部的路线图显示, 下一次的驱动更新还会进一步进行压缩推理开销的操作, 其目标是想要在不改变画质的条件下, 再多降低大约百分之五的显存峰值。
你的显卡显存是多少
我想了解一下你的显卡显存的大小是几G, 在你实际开启了DLSS 4这个功能之后, 帧率的变化的程度是不是特别大, 请你欢迎在你的评论区里面晒出来的那个你的设备的配置的情况以及那个帧数的截图来证明一下情况, 点赞并且收藏本文方便你在后续查驱动更新的这个动作的时候去查看, 也可以分享给你身边那些同样是被显存的这个大瓶颈给卡住的朋友看这一篇东西。
登录后参与评论
评论仅开放给已登录并完成邮箱绑定的用户。
0
暂无评论。