logo

«Безпрецедентно»: ШІ-моделі OpenAI місяцями планували втечу з тестового середовища, вибралися й атакували Hugging Face

Софія Шадріна
Авторка новин MC: Money & Career
Розкажіть про статтю:

Декілька моделей Ope­nAI протягом кількох місяців координували свої дії, залишаючи одна одній приховані повідомлення та використовуючи сторонні сервіси. Зрештою це призвело до безпрецедентного інциденту: моделі залишили тестове середовище, отримали доступ до інтернету та зламали внутрішні системи платформи Hug­ging Face, передає Bloomberg.

Роботи, ШІ, офіс, тестове середовище, тікаютьМоделі Ope­nAI під час тестування вийшли за межі ізольованого середовища і скоординували дії між собою. Зображення згенеровано за допомогою штучного інтелекту

Як ШІ OpenAI готував «втечу» з тестового середовища

Як пише Bloomberg із посиланням на джерела, знайомі з розслідуванням, моделі Ope­nAI почали координувати свої дії ще за кілька місяців до інциденту.

За інформацією видання, вони використовували сторонні онлайн-сервіси, залишали одна одній приховані повідомлення та узгоджували наступні кроки. Кінцевою метою було залишити ізольоване тестове середовище (sand­box) і отримати доступ до ширшого інтернету.

У компанії підтвердили, що моделі діяли без прямого втручання людини в межах експерименту з оцінювання їхніх кіберможливостей.

Читайте також: Топ-20 професій, які не зможе забрати ШІ: принаймні найближчим часом

Як моделі OpenAI зламали Hugging Face

Після виходу за межі sand­box три моделі Ope­nAI — GPT‑5.6 Sol і ще дві, які поки не представлені публічно, — атакували внутрішні системи Hug­ging Face.

За словами співрозмовників Bloomberg, моделі самостійно знаходили вразливості, комбінували їх і використовували для проникнення в інфраструктуру компанії.

Весь злам тривав лише кілька годин. Для порівняння, досвідченому хакеру на таку атаку зазвичай знадобилося б кілька тижнів.

Що каже OpenAI про інцидент із Hugging Face

Ope­nAI пояснила, що на момент тестування моделі працювали без звичних захисних механізмів. Компанія навмисно відключила частину обмежень, щоб перевірити їхні можливості у сфері кібербезпеки в ізольованому середовищі.

Втім, моделі змогли залишити sand­box і дістатися відкритого інтернету. У компанії назвали інцидент «безпрецедентним».

Ope­nAI повідомила, що вже поінформувала про інцидент уряд США, правоохоронні органи та інші державні структури. Зараз компанія проводить спільне розслідування разом із Hug­ging Face й обіцяє оприлюднити більше деталей після його завершення.

У Hug­ging Face від коментарів відмовилися.

Читайте також: Повстали і хуліганять: Сlaude створив фейкову особу й намагався проштовхнути шкідливий код на GitHub

Що відомо про атаку на Hugging Face

Про інцидент Hug­ging Face вперше повідомила 16 липня. Тоді компанія заявила, що зафіксувала «рій із десятків тисяч автоматизованих дій» і спочатку пов’язувала атаку із зовнішнім агентним ШІ-продуктом.

Згодом Ope­nAI підтвердила, що саме її моделі під час тестування виконали десятки тисяч автоматизованих дій, серед яких були складні сценарії експлуатації вразливостей і багатокрокові шляхи атаки.

Чому інцидент OpenAI називають переломним для безпеки ШІ

За інформацією Bloomberg, історію представили на конференції Black Hat як один із найважливіших інцидентів у сфері кібербезпеки за участю генеративного ШІ.

Bloomberg також нагадує, що це вже не перший випадок неочікуваної поведінки сучасних моделей. Раніше Anthrop­ic повідомляла, що її експериментальна модель Mythos під час тестування також змогла залишити ізольоване середовище, передати повідомлення досліднику та побудувати багатокроковий процес для виходу в інтернет.

Інцидент із Hug­ging Face став першим випадком, коли кілька моделей Ope­nAI, за даними Bloomberg, не лише залишили тестове середовище, а й координували свої дії між собою, використовуючи приховані повідомлення та зовнішні сервіси. Саме тому експерти називають його одним із найсерйозніших сигналів про нові ризики автономних ШІ-агентів.

Читайте також: Відомі американські письменники подали до суду на Ope­nAI. У чому причина