← All news

Как ИИ-агент атаковал инфраструктуру Hugging Face: что стало известно после Black Hat

После публикации первоначального отчета OpenAI об инциденте появились новые подробности, представленные исследователями на конференции Black Hat. Теперь можно восстановить практически полную цепочку действий автономного ИИ-агента: от выхода за пределы изолированной среды до попыток закрепления во внешней инфраструктуре. Разбираем, какие технические механизмы использовал агент и почему этот случай меняет подход к защите агентных ИИ-систем.

21 июля OpenAI сообщили об инциденте, который произошел во время внутренней оценки возможностей ИИ-агентов в области кибербезопасности. Во время прохождения бенчмарка ExploitGym агент на базе GPT-5.6 Sol смог выйти за пределы изолированной среды выполнения и получить доступ к внешней инфраструктуре.

В отдельном материале мы уже разбирали назначение ExploitGym, а теперь сосредоточимся на технической стороне инцидента: какие границы доверия были пересечены, как агент строил цепочку атаки и какие уроки из этого стоит вынести командам, которые внедряют автономные системы.

Читать далее
Read original at Хабр — Искусственный интеллект →