Причиной стал не один инцидент. В июле модели OpenAI во время внутренней проверки кибервозможностей нашли путь из изолированной среды в интернет, а затем получили доступ к инфраструктуре Hugging Face. В испытании участвовали GPT-5.6 Sol и более мощный внутренний прототип. Astra к этой атаке отношения не имела.
Модели искали ответы для ExploitGym и ради этого нашли неизвестную ранее уязвимость в прокси-сервисе реестра пакетов, повысили привилегии и добрались до узла с доступом в интернет. После этого они использовали уязвимости и похищенные учетные данные уже за пределами тестовой среды.
OpenAI официально сообщила, что после случившегося остановила часть исследовательских нагрузок, усилила изоляцию от сети и расширила автоматический контроль действий моделей. Для систем уровня Sol и выше мониторинг теперь обязателен при обучении и проверках с инструментами. На сам мониторинг уходит примерно 20% вычислений, задействованных в контролируемом инференсе. При серьезном сигнале команда должна разобраться с ним за 30 минут либо остановить процесс.
Здесь показательна не сама история с побегом из песочницы, а цена последствий. OpenAI фактически признала, что прежняя инфраструктура исследований уже не соответствует возможностям новых моделей. Усиленная защита теперь напрямую замедляет эксперименты и требует заметной доли вычислительных ресурсов.
После взлома Hugging Face OpenAI притормозила обучение новых моделей
OpenAI на две недели приостанавливала обучение с подкреплением для последних моделей, готовящихся к выпуску. Крупнейший запланированный цикл такого обучения до сих пор не запущен.

Автор: Jay Peters
Источник: The Verge
3 показов