AMD ROCm
Программная платформа AMD ROCm создавалась как полноценная открытая альтернатива проприетарным стекам ускоренных вычислений. В эпоху бурного развития генеративного искусственного интеллекта индустрия остро нуждается в диверсификации поставок серверного кремния. Платформа объединяет низкоуровневые драйверы ядра, математические библиотеки, компиляторы и высокоуровневые интерфейсы для запуска сложнейших нейросетевых рабочих нагрузок на графических архитектурах CDNA и RDNA.
Архитектура программного стека и компилятор
Основой платформы служит технология гетерогенных вычислений HIP, позволяющая разработчикам транслировать исходный код с минимальными трудозатратами. Компиляторная инфраструктура на базе LLVM обеспечивает генерацию оптимизированного машинного кода непосредственно под микроархитектуру вычислительных блоков ускорителей Instinct. Это устраняет аппаратные барьеры и позволяет запускать популярные библиотеки без глубокой ручной переработки.
Тесная интеграция с открытым проектом OpenAI Triton и фреймворком PyTorch гарантирует поддержку передовых архитектур нейросетей сразу в день их публичного анонса. Инженеры обучают трансформеры с сотнями миллиардов параметров, используя стандартные операторы и распределенные протоколы связи.
Инструменты для инференса и обучения
Функциональный состав стека закрывает все уровни разработки высоконагруженных серверных сервисов.
- Оптимизированные библиотеки линейной алгебры rocBLAS и сверточных операций MIOpen
- Библиотека распределенных коллективных коммуникаций RCCL для многоузловых серверных кластеров
- Встроенная поддержка FlashAttention и vLLM для скоростного инференса с экономией видеопамяти
- Средства профилирования и отладки производительности ROCprofiler и Omnitrace
- Инструменты мониторинга энергопотребления и температурного режима графических узлов ROCm SMI
Поддержка ускорителей серий Instinct и Radeon
Главный фокус платформы направлен на раскрытие потенциала флагманских ускорителей Instinct MI300X и MI325X, оснащенных рекордным объемом высокоскоростной памяти HBM3 объемом до 256 гигабайт. Архитектура позволяет целиком загружать крупнейшие современные модели Llama 3 и Falcon в видеопамять одного сервера без фрагментации слоев по сетевым интерфейсам.
Для разработчиков настольного софта обеспечена поддержка потребительских видеокарт Radeon RX 7000 и профессиональных карт Radeon PRO под управлением операционных систем Linux и Windows.
Лицензирование и доступность
Программный стек AMD распространяется бесплатно с открытым исходным кодом, что исключает привязку клиентов к закрытым стандартам.
- Программный комплекс ROCm Core - бесплатно под открытыми лицензиями MIT и Apache 2.0
- Готовые оптимизированные образы Docker в реестре AMD Infinity Hub - свободная загрузка
- Аренда серверов с ROCm в облаках Crusoe Cloud, TensorWave и Lambda - от $2.20 за GPU в час
- Пакеты Enterprise поддержки системного уровня - годовой сервисный контракт от $25000 за стойку
- Академические гранты для исследовательских университетов - предоставление бесплатного доступа к суперкомпьютерным центрам
Открытый характер разработки привлекает к развитию платформы крупнейших мировых облачных гиперскейлеров и независимых разработчиков ядра Linux.
Влияние на индустрию искусственного интеллекта
Развитие ROCm разрушило монополию на рынке серверных вычислений и предоставило дата-центрам реальную свободу выбора поставщиков оборудования. Крупнейшие суперкомпьютеры мира Frontier и El Capitan построены на компонентах AMD и используют этот программный стек для моделирования климатических процессов и астрофизических симуляций.
Постоянное совершенствование библиотек сокращает разрыв в производительности и ускоряет внедрение инноваций в коммерческом секторе.