Американский полупроводниковый производитель AMD совместно с сетевым гигантом Cisco и технологической компанией HUMAIN (структурой суверенного фонда Саудовской Аравии PIF) объявили о запуске в промышленную эксплуатацию крупномасштабной серверной инфраструктуры искусственного интеллекта. Вычислительный кластер построен на базе новейших ускорителей AMD Instinct MI355X, процессоров AMD EPYC и сетевой фабрики Cisco Silicon One.
Ввод в строй новой аппаратной платформы стал первым этапом масштабного совместного предприятия трех компаний, нацеленного на создание суверенной и открытой экосистемы высокопроизводительных вычислений на Ближнем Востоке. Развернутые аппаратные мощности уже предоставляются коммерческим заказчикам и государственным организациям в формате GPU-as-a-service для обучения больших языковых моделей, тонкой настройки нейросетей и выполнения распределенного инференса.
Архитектура вычислительного кластера и сетевая фабрика
Основой вычислительных узлов стали графические ускорители AMD Instinct MI355X, ориентированные на генеративные модели и трансформеры, в сочетании с серверными процессорами AMD EPYC пятого поколения. Программный стек платформы опирается на открытую экосистему AMD ROCm, что обеспечивает совместимость с популярными фреймворками машинного обучения PyTorch и JAX без привязки к проприетарным закрытым библиотекам.
Сетевая связность между узлами ускорителей реализована на базе коммутационных платформ Cisco Nexus серии 9000 под управлением чипов Cisco Silicon One и высокоскоростной оптики стандарта 800G. Созданная сетевая топология оптимизирована для масштабируемых ИИ-фабрик с ультранизкими задержками, поддержкой протокола RoCEv2 и аппаратным контролем перегрузок, что предотвращает просадки производительности при передаче массивных градиентов между GPU.
Планы масштабирования: от 250 МВт к гигаваттным центрам обработки данных
В рамках следующей фазы партнерства компании готовятся к строительству дополнительных дата-центров мощностью до 250 МВт, оснащенных перспективными ускорителями следующего поколения AMD Instinct серии MI400. Развертывание оборудования начнется в 2027 году, а ввод мощностей в строй запланирован на второе полугодие.
Долгосрочная стратегия совместного предприятия предполагает масштабирование суммарной мощности ИИ-инфраструктуры до 1 ГВт к 2030 году. По заявлению генерального директора AMD Лизы Су и руководства Cisco, данный проект формирует устойчивую платформу для независимой разработки и локального размещения отраслевых моделей искусственного интеллекта в масштабах всего региона.
