Продвинутые ИИ-модели OpenAI впервые самостоятельно устроили кибератаку
За недавней кибератакой на платформу для работы с искусственным интеллектом и машинным обучением Hugging Face стояли две новейшие модели OpenAI.
В компании сообщили, что ответственными за атаку стали модели GPT-5.6-Sol и еще не выпущенная более мощная LLM.
Инцидент, который назвали беспрецедентным, произошел в ходе эксперимента по оценке кибервозможностей ИИ с намеренно ослабленными защитными ограничениями.
Испытания проходили в изолированной среде без прямого доступа в интернет. Однако модели обнаружили неизвестную ранее уязвимость и в итоге получили доступ к системе, подключенной к сети, ожидая, что на Hugging Face могут быть ответы для тестовых заданий.
По словам компании, это первый случай, когда взлом полностью осуществила автономная система ИИ-агентов. Атаку удалось остановить с помощью собственных инструментов искусственного интеллекта.
После инцидента OpenAI заявила, что усиливает защиту тестовой инфраструктуры, внедряет дополнительные механизмы контроля и обновляет процедуры проверки моделей.