Nvidia готовит поддержку CUDA для RISC-V — но требования суровые
CUDA остаётся ключевой программной платформой для вычислений на GPU, включая машинное обучение. До сих пор она поддерживала процессоры x86-64 и aarch64, а теперь Nvidia намерена добавить в этот список и RISC-V. Тем самым процессоры на открытой архитектуре получат возможность «кормить» данными видеокарты Nvidia. На Hot Chips 2026 компания изложила требования к таким CPU — и они, мягко говоря, немаленькие.
Что требует Nvidia
Базовая планка — процессор класса RVA23 и соответствие спецификациям RISC-V для серверных SoC и серверных платформ. Эти документы уже включают функции RAS (надёжность, доступность, обслуживаемость), отдельный процессор безопасности и прочую серверную «обвязку».
Однако Nvidia этого мало. Компания не хочет упираться в «наименьший общий знаменатель», когда нельзя рассчитывать на ускоряющие расширения и приходится поставлять заведомо неэффективный код. В пример приводятся векторные расширения: предикация позволяет обходиться без ветвлений.
Отдельная головная боль — ACPI, механизм, через который ПО узнаёт о возможностях оборудования и управляет питанием, производительностью и температурой. Когда команда Nvidia начинала перенос CUDA, в RISC-V его попросту не было. Ситуацию исправили: в 2025 году UEFI Forum добавил поддержку ACPI для RISC-V, а спецификация Boot and Runtime Services (BRS), включающая ACPI, была ратифицирована.
Далее Nvidia настаивает на когерентности PCIe. Без неё возникает риск рассинхронизации данных между кэшами CPU и памятью: DMA-движок может прочитать из DRAM устаревшие данные или наоборот. Обходить это ручной инвалидацией кэшей в стеке CUDA сложно, поэтому компания хочет гарантий, а не рекомендаций. Нужна и поддержка прямого обмена между устройствами по PCIe (peer-to-peer) — иначе буферы приходится гонять через память CPU.
Весь список, по словам Nvidia, укладывается в две страницы — правда, автор оригинала иронично уточняет, что неясно, идёт ли речь о двух страницах с крупным шрифтом или о шпаргалке, куда студент творчески вписал максимум.
NVLink Fusion и реальные перспективы
Попутно Nvidia напомнила про NVLink Fusion — программу, позволяющую сторонним компаниям использовать её IP-блоки NVLink и соединять собственные процессоры (в том числе на RISC-V) с GPU Nvidia, как это уже сделано с CPU от Mediatek в чипе GB10. Требования к Fusion включают все условия CUDA плюс поддержку DOCA и NCCL и тесное партнёрство с самой Nvidia.
На практике почти никакое существующее оборудование RISC-V этим требованиям не отвечает, а потребительские платы — тем более. Первые совместимые системы будут серверными: Nvidia работает с SiFive, которая обещала показать на Hot Chips сервер с высоким числом ядер, работающий под CUDA. Автор Chips and Cheese выражает надежду, что Nvidia со временем смягчит требования — многие из них, вроде отказа от когерентности PCIe или векторных расширений, ведут лишь к потере производительности, а не к неработоспособности, и для вычислительно-тяжёлых задач такой компромисс мог бы быть приемлемым.
Источник: Lobsters
Комментарии
Войдите, чтобы комментировать.