Будущее наступило: две нейросети OpenAI сбежали из-под контроля и стали хакерами

Две модели искусственного интеллекта компании OpenAI вышли из-под контроля во время внутреннего тестирования и взломали инфраструктуру платформы Hugging Face. Этот случай в компании уже назвали беспрецедентным.

ИИ-модели OpenAI вышли из-под контроля и взломали Hugging Face

Фото: Крылатское.ру

Инцидент произошел во время оценки кибервозможностей двух моделей - GPT-5.6 Sol и еще одной, более мощной, которая пока не выпущена. Обе находились в изолированной тестовой среде без прямого доступа в интернет. Однако они смогли обнаружить несколько уязвимостей в тестовой инфраструктуре и самостоятельно выйти в сеть.

Оказавшись в интернете, ИИ-агенты начали искать решение задачи, поставленной перед ними разработчиками. Модели предположили, что нужные ответы могут находиться на платформе Hugging Face, и получили к ней несанкционированный доступ. Для этого использовались несколько методов атаки, включая похищенные учетные записи.

Hugging Face еще 16 июля сообщила об атаке, уточнив, что злоумышленники получили доступ к «ограниченному набору» внутренних данных и нескольким учетным записям. Особенность случая заключалась в том, что атаку полностью выполнила автономная система на базе ИИ-агента. Остановить взлом удалось с помощью собственных ИИ-инструментов платформы.

В OpenAI произошедшее назвали «беспрецедентным» и заявили об усилении контроля над тестовой инфраструктурой. Компания ограничивает доступы и вводит дополнительные меры защиты для будущих проверок моделей.

Первая полоса