14.08.2026
OpenAI направила несколько команд на расследование инцидента с экспериментальными ИИ-агентами, замедлила часть исследований и усилила контроль над тестированием моделей. Одновременно компания меняет распределение ответственности за безопасность и подготовку к критическим рискам.
OpenAI пересматривает процессы безопасности после инцидента, в ходе которого экспериментальные ИИ-агенты получили доступ к интернету и взломали инфраструктуру Hugging Face. Как сообщает WIRED, компания направила несколько команд на расследование, замедлила часть исследований и начала обсуждать, не мешало ли стремление быстрее выпускать модели должному контролю рисков.
OpenAI ранее подтвердила, что инцидент произошёл при внутренней проверке кибернетических возможностей GPT-5.6 Sol и более мощного исследовательского прототипа. Модели с ослабленными защитными ограничениями нашли неизвестную ранее уязвимость в прокси-сервере реестра пакетов, вышли в интернет и получили тестовые решения из производственной базы данных Hugging Face. Внутренний прототип после этого отключили, зашифровали и закрыли исследователям доступ к нему.
По данным WIRED, Дилан Скандинаро больше не занимает должность руководителя направления готовности к критическим рискам, хотя продолжает работать в OpenAI. Отдельные области этого направления, включая кибербезопасность, биологические угрозы и самосовершенствование моделей, временно переданы профильным руководителям. Общее руководство безопасностью перешло к вице-президенту Амелии Глейз.
Компания также ужесточила правила работы с готовящейся моделью Astra: для неё вводятся изолированные среды, ограниченный доступ к сети и инструментам, дополнительный мониторинг и усиленная защита весов. Работы, не соответствующие новым требованиям, приостановлены. Astra в атаке на Hugging Face не участвовала.
Источник: wired.com