IT之家 9 月 15 日消息,据科技媒体 Tom's Hardware 昨日(9 月 14 日)报道,开源项目 CUDA-for-AMD-Windows 正在挑战英伟达的 CUDA 技术壁垒,已成功在 AMD Radeon RX 9060 XT 上运行部分 CUDA 库的演示。
IT之家注:CUDA 是英伟达的通用 GPU 加速计算平台,包含编译器、运行时、调试器、性能分析工具,以及可直接调用的 GPU 加速库。
由于 CUDA 与英伟达 GPU 在开发平台、加速库、工具链及开发者生态上紧密绑定,因此被视为英伟达的“护城河”。
开发者 Speedstu 推出的 CUDA-for-AMD-Windows 开源项目,是一套可重复的 PowerShell 自动化配置方案。该方案结合了 ZLUDA 翻译层与 AMD 原生 HIP / ROCm,在 Windows 系统上为依赖 CUDA 的 RTX 等软件提供“翻译接口”。
该配置脚本会检测 GPU 架构,并下载固定的 ZLUDA v6-preview.69 版本。随后,工具会尝试将 CUDA 调用映射到 Windows 上已安装的 ROCm 数学库。
在兼容性方面,开发者已拦截 CUDA 驱动程序 API,同时 cuBLAS、cuSPARSE 和 cuFFT 也能映射至 AMD 对应组件。因此,部分原本仅面向 NVIDIA CUDA 的应用,可在 Windows 系统的 AMD 显卡上尝试运行。
在概念验证项目中,该开发者使用未修改的 CUDA 库,在 AMD Radeon RX 9060 XT 上完成了端到端的 220 万参数 PPO 强化学习网络训练。
此外,项目文档还提供了 Radeon RX 9060 XT 的 A/B 测试结果。官方上游路径采用官方 ZLUDA 与 AMD HIP SDK 6.4。
其中,整体中位吞吐量为 13278.46 SPS,平均吞吐量为 13172.49 SPS。而恢复自定义覆盖路径的整体中位吞吐量为 12875.80 SPS,平均吞吐量为 12649.83 SPS。
| 指标 | 公开上游路径 | 恢复的自定义路径 | 自定义路径变化 |
|---|---|---|---|
| 总体 SPS,中位数 | 13,278.46 | 12,875.80 | -3.03% |
| 总体 SPS,平均值 | 13,172.49 | 12,649.83 | -3.97% |
| 数据采集 SPS,中位数 | 63,306.00 | 59,360.67 | -6.23% |
| 数据消耗 SPS,中位数 | 16,806.36 | 16,445.66 | -2.15% |
| 推理时间,中位数 | 0.5863 秒 | 0.6293 秒 | +7.33% |
| PPO 学习时间,中位数 | 3.2076 秒 | 3.2958 秒 | +2.75% |
SPS 指每秒步数(steps per second)。表中“恢复的自定义路径”(包含旧版定制 ZLUDA 组件的配置)相比“公开上游路径”(标准、公开可用的配置),吞吐量均有所降低,而推理和 PPO 学习耗时则更长。
参考
- 点此前往 GitHub 访问 CUDA for AMD on Windows 开源项目