Компания AMD опубликовала отчет о прогрессе в разработке высокоплотных стоечных серверов для обучения и инференса нейросетей. По официальным данным компании, комплексные стоечные решения 2026 года на базе процессоров EPYC и ускорителей Instinct демонстрируют четырехкратный (4X) прирост энергоэффективности в расчете на ватт по сравнению с платформой поколения 2024 года.
Энергопотребление дата-центров стало главным сдерживающим фактором для масштабного развертывания генеративных нейросетей. Ограничения по доступной электрической мощности подстанций заставляют разработчиков серверного кремния фокусироваться не только на чистой пиковой производительности TFLOPS, но и на удельной эффективности вычислений на каждый затраченный киловатт энергии.
Архитектурные факторы 4-кратного прорыва
Достижение четырехкратного роста эффективности в стоечных решениях AMD (архитектура Helios) обусловлено комплексом инженерных инноваций:
- Переход на архитектуру CDNA 4 и техпроцессы 3 нм: новые графические ускорители серии Instinct MI350 используют оптимизированные тензорные блоки с аппаратной поддержкой сверхкомпактных форматов FP4 и FP6 (microscaling formats). Это снижает объем пересылаемых данных и нагрузку на подсистему памяти без потери точности весов моделей.
- Процессоры EPYC 5-го поколения (Turin): ядра Zen 5 на нормах TSMC N4/N3 обеспечивают высокую плотность управляющих потоков при сниженном базовом напряжении питания.
- Оптимизация межчиповых соединений Infinity Fabric: интеграция высокоскоростных интерфейсов связи нового поколения снизила удельные энергозатраты на межузловую передачу данных в распределенных кластерах.
- Жидкостное охлаждение стоечного уровня: переход на прямые водоблоки для чипов и теплообменники типа жидкость-жидкость позволил сократить затраты энергии на вентиляцию шасси до минимума.
Опережение графика инициативы «30x25 / 20x30»
Ранее AMD ставила цель достичь 30-кратного повышения энергоэффективности вычислительных узлов к 2025 году, а затем скорректировала план с учетом масштабирования до уровня полных серверных стоек (20-кратный рост эффективности кластера к 2030 году). Текущие замеры платформы 2026 года показывают, что компания опережает собственный график на 18%.
Для корпоративных заказчиков и облачных провайдеров такой прогресс означает возможность разместить в четыре раза больше вычислительных мощностей в рамках прежнего лимита энергоснабжения серверного зала (например, 100 кВт на стойку), что напрямую снижает совокупную стоимость владения (TCO) инфраструктурой.
Источники
- Tom's Hardware, 2026-08-18
- AMD Newsroom, 2026-08-18
