Самая интересная часть эксперимента с CUDA на Radeon RX 9060 XT заключается не в самом факте запуска. ZLUDA уже много лет пытается исполнять CUDA-приложения на видеокартах AMD. Разработчик CUDA-for-AMD-Windows собрал вокруг нее воспроизводимую конфигурацию для Windows: ZLUDA v6-preview.69 принимает обращения CUDA-программы, а затем передает поддерживаемые операции библиотекам AMD HIP и ROCm. На проверенной системе заработали CUDA Driver API, cuBLAS, cuBLASLt, cuSPARSE и cuFFT.
Проверка была сложнее простого запуска тестовой утилиты. На Radeon RX 9060 XT выполнили полный цикл обучения PPO-сети с 2 216 347 параметрами через CUDA-версию LibTorch 2.3.0. Одна контрольная итерация обработала 65 536 шагов. Код самой CUDA-библиотеки при этом не переписывали под HIP. Сейчас автор проекта считает проверенной только RX 9060 XT с архитектурным идентификатором gfx1200. Поддержка других Radeon пока не подтверждена.
Есть и полезный A/B-тест, который отделяет рабочую схему от прежних экспериментов разработчика. На одной RX 9060 XT провели по десять запусков одинаковой PPO-нагрузки. После исключения первой прогревочной итерации открытая конфигурация на обычных компонентах ZLUDA и HIP дала медиану 13 278 шагов в секунду. Вариант со старыми восстановленными модифицированными библиотеками получил 12 876 шагов в секунду, примерно на 3% меньше. То есть для этого теста никаких закрытых или специально доработанных бинарников уже не требуется.

