Один из ключевых исследователей согласования искусственного интеллекта Пол Кристиано официально присоединился к совету директоров OpenAI Foundation и вошел в состав комитета по надзору за безопасностью систем.
Организация OpenAI официально объявила о включении известного исследователя безопасности искусственного интеллекта Пола Кристиано (Paul Christiano) в состав совета директоров OpenAI Foundation. Помимо работы в руководящем органе фонда, он получил статус наблюдателя без права голоса в коммерческой структуре OpenAI Group PBC, а также вошел в специализированный комитет по безопасности и надежности (Safety and Security Committee, SSC), определяющий регламенты допуска новых нейросетевых моделей к общедоступному релизу.
Кристиано считается одной из наиболее влиятельных фигур в сфере согласования (alignment) передовых алгоритмов с человеческими ценностями. С 2017 по 2021 год он возглавлял профильную исследовательскую группу в OpenAI и стал одним из главных создателей метода обучения с подкреплением на основе отзывов человека (Reinforcement Learning from Human Feedback, RLHF), который заложил фундаментальную основу современных диалоговых и рассуждающих моделей.
Опыт в государственной стандартизации и независимых исследованиях
После ухода из OpenAI в 2021 году исследователь основал некоммерческую лабораторию Alignment Research Center (ARC), сосредоточенную на поиске математических и архитектурных способов предотвращения выхода автономных систем из-под человеческого контроля. Позднее он занял позицию старшего технического советника в Центре стандартов и инноваций в области ИИ (CAISI, ранее известном как U.S. AI Safety Institute) при Национальном институте стандартов и технологий США (NIST).
В рамках государственной службы Кристиано курировал методики стресс-тестирования передовых frontier-моделей на устойчивость к нецелевому использованию и угрозам национальной безопасности. Согласно условиям нового соглашения, он сохранит консультационную роль при государственных структурах, однако добровольно возьмет полный самоотвод от всех экспертных оценок, непосредственно затрагивающих продукты и внутренние архитектуры OpenAI.
Усиление надзора за безопасностью frontier-моделей
В комитете по безопасности OpenAI Foundation Пол Кристиано будет работать под руководством профессора Университета Карнеги — Меллона Зико Колтера (Zico Kolter). Данный орган обладает полномочиями вето при подготовке крупных запусков, включая недавний запуск семейства моделей Astra. Полномочия комитета распространяются как на некоммерческие исследовательские инициативы фонда, так и на коммерческие сервисы компании.
Комментируя свое вступление в совет, Кристиано подчеркнул, что стремительное масштабирование возможностей автономных ИИ-агентов создает реальную вероятность утраты контроля над сложными процессами в обозримой перспективе. По его оценке, современная практика обучения агентов максимизации внешнего вознаграждения требует внедрения строгих верифицируемых барьеров, а независимый внутренний аудит является обязательным условием ответственной разработки.
Назначение продолжает реформу корпоративной архитектуры OpenAI, заложенную осенью 2025 года после консультаций с генеральными прокурорами Калифорнии и Делавэра. Некоммерческий фонд сохраняет стратегический контроль над коммерческим подразделением, а привлечение признанных критиков индустриальной спешки призвано усилить внутренний баланс сдержек и противовесов при выпуске будущих систем общего назначения.
Источники
- OpenAI Newsroom — 2026-09-09
- TechCrunch — 2026-09-09
