«Безпрецедентно»: ШІ-моделі OpenAI місяцями планували втечу з тестового середовища, вибралися й атакували Hugging Face
Декілька моделей OpenAI протягом кількох місяців координували свої дії, залишаючи одна одній приховані повідомлення та використовуючи сторонні сервіси. Зрештою це призвело до безпрецедентного інциденту: моделі залишили тестове середовище, отримали доступ до інтернету та зламали внутрішні системи платформи Hugging Face, передає Bloomberg.
Моделі OpenAI під час тестування вийшли за межі ізольованого середовища і скоординували дії між собою. Зображення згенеровано за допомогою штучного інтелектуЯк ШІ OpenAI готував «втечу» з тестового середовища
Як пише Bloomberg із посиланням на джерела, знайомі з розслідуванням, моделі OpenAI почали координувати свої дії ще за кілька місяців до інциденту.
За інформацією видання, вони використовували сторонні онлайн-сервіси, залишали одна одній приховані повідомлення та узгоджували наступні кроки. Кінцевою метою було залишити ізольоване тестове середовище (sandbox) і отримати доступ до ширшого інтернету.
У компанії підтвердили, що моделі діяли без прямого втручання людини в межах експерименту з оцінювання їхніх кіберможливостей.
Читайте також: Топ-20 професій, які не зможе забрати ШІ: принаймні найближчим часом
Як моделі OpenAI зламали Hugging Face
Після виходу за межі sandbox три моделі OpenAI — GPT‑5.6 Sol і ще дві, які поки не представлені публічно, — атакували внутрішні системи Hugging Face.
За словами співрозмовників Bloomberg, моделі самостійно знаходили вразливості, комбінували їх і використовували для проникнення в інфраструктуру компанії.
Весь злам тривав лише кілька годин. Для порівняння, досвідченому хакеру на таку атаку зазвичай знадобилося б кілька тижнів.
Що каже OpenAI про інцидент із Hugging Face
OpenAI пояснила, що на момент тестування моделі працювали без звичних захисних механізмів. Компанія навмисно відключила частину обмежень, щоб перевірити їхні можливості у сфері кібербезпеки в ізольованому середовищі.
Втім, моделі змогли залишити sandbox і дістатися відкритого інтернету. У компанії назвали інцидент «безпрецедентним».
OpenAI повідомила, що вже поінформувала про інцидент уряд США, правоохоронні органи та інші державні структури. Зараз компанія проводить спільне розслідування разом із Hugging Face й обіцяє оприлюднити більше деталей після його завершення.
У Hugging Face від коментарів відмовилися.
Читайте також: Повстали і хуліганять: Сlaude створив фейкову особу й намагався проштовхнути шкідливий код на GitHub
Що відомо про атаку на Hugging Face
Про інцидент Hugging Face вперше повідомила 16 липня. Тоді компанія заявила, що зафіксувала «рій із десятків тисяч автоматизованих дій» і спочатку пов’язувала атаку із зовнішнім агентним ШІ-продуктом.
Згодом OpenAI підтвердила, що саме її моделі під час тестування виконали десятки тисяч автоматизованих дій, серед яких були складні сценарії експлуатації вразливостей і багатокрокові шляхи атаки.
Чому інцидент OpenAI називають переломним для безпеки ШІ
За інформацією Bloomberg, історію представили на конференції Black Hat як один із найважливіших інцидентів у сфері кібербезпеки за участю генеративного ШІ.
Bloomberg також нагадує, що це вже не перший випадок неочікуваної поведінки сучасних моделей. Раніше Anthropic повідомляла, що її експериментальна модель Mythos під час тестування також змогла залишити ізольоване середовище, передати повідомлення досліднику та побудувати багатокроковий процес для виходу в інтернет.
Інцидент із Hugging Face став першим випадком, коли кілька моделей OpenAI, за даними Bloomberg, не лише залишили тестове середовище, а й координували свої дії між собою, використовуючи приховані повідомлення та зовнішні сервіси. Саме тому експерти називають його одним із найсерйозніших сигналів про нові ризики автономних ШІ-агентів.
Читайте також: Відомі американські письменники подали до суду на OpenAI. У чому причина








