驱动之家 昨天
能跑但只有2帧!把DLSS 5硬塞进苹果芯片:延迟高达240ms
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

快科技 9 月 15 日消息,近日有开发者成功将英伟达最新的 DLSS 5 神经渲染管线移植到了苹果 Apple Silicon 硬件平台上,实现了跨架构的 AI 渲染突破。

据开发者社区消息,此次移植由开发者 @iamwavecut 与 @Mappsnet7 共同完成,他们利用苹果自家的 Metal 图形接口作为底层桥梁,配合 Game Porting Toolkit 4.0b2 和 ReShade 注入工具,成功绕过了显卡厂商的驱动封锁。

这意味着本应在 RTX 50 系列显卡张量核心上运行的深度学习模型,现在可以直接在苹果 M 系列芯片的 GPU 上执行。

要知道 DLSS 5 与此前的版本有本质不同,它并非单纯的后期滤镜,而是深度嵌入游戏渲染管线的 " 神经渲染阶段 ",需要与引擎的原始绘图调用、运动矢量和帧历史数据进行实时交互。

而开发者通过手动翻译运行时环境,让苹果的 M5 Pro 能够理解这些原本为 CUDA 架构设计的指令,在视觉上实现了表面光照和接触阴影的明显改善。

性能实测中,在搭载 M5 Pro 芯片(16 核 GPU 配置)的 MacBook Pro 上,以 1440p 分辨率运行游戏时,平均帧率仅为 2.32 FPS,且系统输入延迟飙升至 240 毫秒。

相比之下,主流玩家追求的系统延迟通常在 20-30 毫秒以内,简单来说,这次移植目前更像是一个 " 证明可行性 " 的技术秀,而非能够日常使用的实用工具。

而且从芯片架构的底层逻辑来看,性能崩溃的根源在于精度计算的缺失,NVIDIA DLSS 5 原生基于 FP8 精度计算设计,以实现极高的 AI 运算效能。

但苹果 M5 Pro 缺乏专用的 FP8 硬件计算单元,只能被迫使用 FP16 指令集代偿,这种口径差异导致系统的数学计算负载直接翻倍,再加上多层翻译层的额外开销,使得 GPU 即使在满载状态下也只能输出 " 幻灯片 " 级的画面。

【本文结束】如需转载请务必注明出处:快科技

责任编辑:青山

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 芯片 gpu 翻译 分辨率
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论