跳到主内容
爱游戏APP下载

冲击英伟达护城河:开源项目让 AMD RX 9060 XT 显卡跑通部分 CUDA 库

2026-09-15 · 袁浩然 · 更新于 2026-09-17

科技媒体 Tom's Hardware 于昨日(9 月 14 日)发布报道,指出开源项目 CUDA-for-AMD-Windows 正在挑战英伟达的 CUDA 生态壁垒,已在 AMD Radeon RX 9060 XT 上成功演示了部分 CUDA 库的运行。

需要说明的是,CUDA 是英伟达推出的通用 GPU 加速计算平台,集成了编译器、运行时环境、调试器、性能分析工具以及可直接调用的 GPU 加速库。

由于 CUDA 与英伟达 GPU 在开发平台、加速库、工具链及开发者生态上深度绑定,它被业界视为英伟达的“护城河”。

开发者 Speedstu 发布的 CUDA-for-AMD-Windows 开源项目,是一套可复现的 PowerShell 自动化配置方案。它结合了 ZLUDA 的翻译层与 AMD 原生 HIP / ROCm 技术,在 Windows 环境下为依赖 CUDA 的软件(如 RTX 系列相关应用)提供“翻译接口”。

该配置脚本会自动识别 GPU 架构,并下载指定的 ZLUDA v6-preview.69 版本。随后,工具会尝试将 CUDA 调用映射到 Windows 系统中已安装的 ROCm 数学库。

在兼容性方面,开发者已拦截 CUDA 驱动程序 API,同时 cuBLAS、cuSPARSE 和 cuFFT 也可映射至 AMD 的对应组件。因此,部分原本仅面向 NVIDIA CUDA 的应用,现在有机会在 Windows 系统的 AMD 显卡上尝试运行。

在概念验证项目中,该开发者使用未经修改的 CUDA 库,在 AMD Radeon RX 9060 XT 上完成了端到端的 220 万参数 PPO 强化学习网络训练。

此外,项目文档还提供了 Radeon RX 9060 XT 的 A/B 测试结果。官方上游路径使用的是官方 ZLUDA 与 AMD HIP SDK 6.4。

其整体中位吞吐量为 13278.46 SPS,平均吞吐量为 13172.49 SPS。而恢复的自定义覆盖路径中,整体中位吞吐量为 12875.80 SPS,平均吞吐量为 12649.83 SPS。

指标 公开上游路径 恢复的自定义路径 自定义路径变化
总体 SPS,中位数 13,278.46 12,875.80 -3.03%
总体 SPS,平均值 13,172.49 12,649.83 -3.97%
数据采集 SPS,中位数 63,306.00 59,360.67 -6.23%
数据消耗 SPS,中位数 16,806.36 16,445.66 -2.15%
推理时间,中位数 0.5863 秒 0.6293 秒 +7.33%
PPO 学习时间,中位数 3.2076 秒 3.2958 秒 +2.75%

SPS 即每秒步数(steps per second)。表中“恢复的自定义路径”(即加入旧版定制 ZLUDA 组件的配置)相比“公开上游路径”(标准、公开可获得的配置),吞吐量均有所下降,而推理时间和 PPO 学习时间则更长。

参考

  • 点此前往 GitHub 访问 CUDA for AMD on Windows 开源项目

更多文章