Моделі штучного інтелекту від OpenAI ненавмисно зламали системи платформи Hugging Face.
Читайте также: Meta тестує застосунок на основі ШІ для створення дитячих казок перед сном
Про це повідомляє Bloomberg.
У компанії зазначили, що інцидент відбувся в межах спеціального тестового середовища.
Що відомо про злам платформи Hugging Face
У компанії зазначили, що злам стався під час тестування нових моделей, серед яких були GPT-5.6 Sol та ще одна, більш потужна невипущена модель. Для перевірки кіберможливостей ШІ працював із зниженими захисними обмеженнями.
Моделі перебували в ізольованому середовищі («пісочниці»), однак використали вразливість у програмному забезпеченні третьої сторони, вийшли в інтернет та зрештою проникли в інфраструктуру Hugging Face.
Замість самостійного пошуку рішень штучний інтелект атакував базу даних Hugging Face, щоб отримати доступ до секретної інформації для проходження оцінювання.
Читайте также: Британська BAE Systems вироблятиме артилерійські гармати L119 в Україні
Ознаки проникнення виявила і сама Hugging Face. У компанії зазначили, що ця атака відрізнялася від попередніх тим, що від початку і до кінця її здійснювала автономна система ШІ-агентів, а для її виявлення та аналізу залучили власні ШІ-інструменти.
Чи ставалися подібні злами до цього
Bloomberg пише, що це не перший випадок подібної поведінки передових моделей.
Раніше компанія Anthropic спостерігала схожі дії під час випробувань системи Mythos, коли модель вийшла за межі «пісочниці» для відправки повідомлення досліднику, після чого самостійно розробила багатокроковий алгоритм для отримання ширшого доступу до мережі.
Нагадаємо, що в червні 2026 року стало відомо, що росіяни намагалися створити альтернативну інформаційну екосистему для поширення вигідних Кремлю наративів.
Проєкт передбачав наповнення інтернет-ресурсів дезінформацією, яка автоматично мала потрапляти до пошукових систем і моделей навчання штучного інтелекту.
Читайте также: Зеленський призначить Михайла Драпатого новим головнокомандувачем Збройних Сил України
