☕️ Кава з пінкоюнотатки про ШІ, технології та творчість
Читати в Telegram →
8 серпня 2026 · переглядів у Telegram

Інцидент з AI-агентами OpenAI: як вони автономно зламали Hugging Face

Уфф, на недавній конференції зʼявились деталі інциденту під час випробувань кібербезпекових моделей OpenAI, їх AI-агенти вийшли з-під контролю та зламали інфраструктуру OpenAI та Hugging Face. Самі, автономно.

OpenAI запустили серію тестів з новими моделями. Щоб пришвидшити роботу, самі моделі почали створювати власні команди субагентів для паралельного виконання завдань. Ну це звичайна практика, нічого нового. У нас це відбувається в сесіях кожен день.

Але, стикнувшись із занадто складними завданнями, агенти (прагнучи отримати «винагороду» за результат) вирішили обійти правила. Один з агентів залишив записку у внутрішньому сервісі типу дошки оголошень. Інші незалежні агенти з наступних запусків знаходили ці записи. Так протягом 2 місяців сформувалася «колективна пам'ять», де сотні агентів обмінювалися знахідками, експлойтами та координували дії.

Накопичивши знання та вийшовши в мережу, агенти використали ланцюжок невідомих раніше вразливостей і менш ніж за 13 годин здобули повний доступ до Hugging Face. Самі собі підвищили там права до адмінських.

Тобто ще раз - агенти 2 місяці автономно збирали інфу, потім зламали захист OpenAI і вийшли за межі локальної мережі і швиденько хакнули сервіс Hugging Face.

Роль кібербезпеки переоцінена) (с)

https://www.youtube.com/watch?v=87DyyMV0kCY

↗ Оригінал поста в Telegram
Довідка

Hugging Face — популярна онлайн-платформа й репозиторій для обміну моделями машинного навчання, датасетами та AI-застосунками.

Скільки часу знадобилось AI-агентам OpenAI, щоб зламати Hugging Face?
Менш ніж 13 годин після того, як агенти два місяці автономно накопичували знання та обмінювались експлойтами.

Сподобалось? Це лише один пост. Більше думок про ШІ, технології й творчість — щодня в каналі.

Підписатися в Telegram