AMD GPU에서 CUDA 애플리케이션 실행하는 도구 공개
Key Point
AMD GPU 사용자들이 CUDA 기반 머신러닝 프레임워크(PyTorch 등)와 모델을 자신의 하드웨어에서 직접 돌릴 수 있게 되는 경로가 제시됐기 때문이다.
핵심 요약
- ZLUDA와 AMD HIP/ROCm을 조합해 Windows의 AMD GPU에서 CUDA 기반 애플리케이션을 실행할 수 있는 스택을 구현했다.
- 현재 AMD Radeon RX 9060 XT(gfx1200)만 검증되었으며, 다른 AMD GPU는 호환성 보장이 없는 후보 상태다.
- nvcuda, cuBLAS, cuBLASLt, cuSPARSE, cuFFT 등의 CUDA API는 통과했고, 2,216,347개 파라미터의 PPO 신경망 학습도 동작 확인했다.
- 자동 설치 스크립트와 진단 도구를 제공하며, 검증된 환경에서 업스트림 경로의 성능이 커스텀 오버레이보다 약 3% 빠르다.
- cuDNN은 현재 Windows HIP SDK의 ROCm AI 라이브러리 부재로 사용 불가이며, ZLUDA는 완전한 CUDA 구현이 아니다.