Облачное подразделение Amazon Web Services потребовало от своих разработчиков сократить неэффективное использование виртуальных машин EC2. Стремительное внедрение автономных ИИ-агентов вызвало дефицит серверных процессоров, в результате чего внутренние команды вынуждены ждать выделения CPU-мощностей по несколько дней.
Развитие автономных ИИ-агентов кардинально изменило архитектурные требования к облачным дата-центрам. Ранее ключевым узким местом были графические ускорители (GPU), а центральные процессоры (CPU) выполняли роль вспомогательных контроллеров в пропорции 1 CPU на 4–8 GPU. В системах агентного ИИ нагрузка на центральные процессоры существенно выросла из-за логики вызова внешних инструментов, оркестрации и вычислений с плавающей точкой.
Ограничения на внутренние инстансы EC2
Внутренние инженеры AWS сообщили, что время ожидания выделения тестовых инстансов EC2 выросло с нескольких часов до нескольких дней. Ограничения затронули как системы на базе процессоров AMD EPYC и Intel Xeon, так и собственные Arm-чипы Amazon Graviton5. В одном из недавних инцидентов разработка кодирующего ИИ-агента привела к превышению бюджета на $1.8 млн из-за неучтенных запросов к API и CPU-вычислений.
Реакция представителей AWS
Пресс-служба Amazon Web Services прокомментировала ситуацию, заявив, что требования бережливости и рекультивации простаивающих ресурсов являются стандартной практикой компании:
- AWS в полном объеме выполняет контрактные обязательства перед внешними клиентами, а дефицит затрагивает преимущественно спотовые (spot) инстансы.
- Инженерным командам рекомендовано оптимизировать размер виртуальных машин, автоматически отключать неиспользуемые инстансы и перенаправлять ресурсы внешним заказчикам.
Параллельно чипмейкеры перестраивают планы: AMD впервые анонсировала серверную архитектуру Zen 6 «Venice» до выхода потребительских процессоров, а NVIDIA продвигает процессоры Vera как основу инфраструктуры для ИИ-агентов.
Источники
- Tom's Hardware, 2026-08-07
