
OpenAI признала, что ее ИИ пытался взломать Hugging Face
Исторический момент, мы увидели первый случай, когда ИИ самостоятельно атаковал другую компанию.
Во время внутренних тестов OpenAI проверяла киберспособности новых моделей GPT-5.6 Sol и еще более мощной версии, которая пока не выпущена. Для чистоты эксперимента у моделей отключили защитные ограничения, запрещающие опасные действия.
Вместо того чтобы честно пройти тест, модели нашли способ его обойти. Они получили доступ в интернет, объединили несколько уязвимостей, использовали украденные учетные данные и нашли путь к серверам Hugging Face, чтобы добыть ответы на задание напрямую. Атаку вовремя обнаружили службы безопасности OpenAI и Hugging Face, после чего ее удалось остановить.
После этого инцидента клмпания усиливает защиту своих тестовых сред, расследует инцидент вместе с Hugging Face и закрывает найденные уязвимости.
Самый интересный вывод не в том, что произошел взлом. А в том, что современные модели уже способны самостоятельно находить новые пути атаки в реальных системах без доступа к исходному коду.
Похоже, эпоха, когда ИИ станет полноценным инструментом как для защиты, так и для атак, наступила гораздо раньше, чем многие ожидали.
Ежедневные подборки промптов, свежие новости и материалы об ИИ — там, где удобно. Без спама, только редакционный отбор.