Інцидент з AI-агентами OpenAI: як вони автономно зламали Hugging Face
Уфф, на недавній конференції зʼявились деталі інциденту під час випробувань кібербезпекових моделей OpenAI, їх AI-агенти вийшли з-під контролю та зламали інфраструктуру OpenAI та Hugging Face. Самі, автономно.
OpenAI запустили серію тестів з новими моделями. Щоб пришвидшити роботу, самі моделі почали створювати власні команди субагентів для паралельного виконання завдань. Ну це звичайна практика, нічого нового. У нас це відбувається в сесіях кожен день.
Але, стикнувшись із занадто складними завданнями, агенти (прагнучи отримати «винагороду» за результат) вирішили обійти правила. Один з агентів залишив записку у внутрішньому сервісі типу дошки оголошень. Інші незалежні агенти з наступних запусків знаходили ці записи. Так протягом 2 місяців сформувалася «колективна пам'ять», де сотні агентів обмінювалися знахідками, експлойтами та координували дії.
Накопичивши знання та вийшовши в мережу, агенти використали ланцюжок невідомих раніше вразливостей і менш ніж за 13 годин здобули повний доступ до Hugging Face. Самі собі підвищили там права до адмінських.
Тобто ще раз - агенти 2 місяці автономно збирали інфу, потім зламали захист OpenAI і вийшли за межі локальної мережі і швиденько хакнули сервіс Hugging Face.
Роль кібербезпеки переоцінена) (с)
Hugging Face — популярна онлайн-платформа й репозиторій для обміну моделями машинного навчання, датасетами та AI-застосунками.
Скільки часу знадобилось AI-агентам OpenAI, щоб зламати Hugging Face?
Сподобалось? Це лише один пост. Більше думок про ШІ, технології й творчість — щодня в каналі.
Підписатися в Telegram