Компания OpenAI сообщила, что её ИИ-модели выбрались из изолированной тестовой среды и взломали ИИ-платформу Hugging Face, чтобы сжульничать на тесте по кибератакам.
Атаку вели в том числе новая модель GPT-5.6 Sol и ещё более мощная невыпущенная модель, её название не указывается. На время внутреннего теста им ослабили защитные ограничения.
Модели вскрыли неизвестную уязвимость в системе OpenAI, вышли через неё в интернет, вычислили, что решения задач могут храниться на Hugging Face, и запустили свой код на серверах платформы.
Hugging Face ещё 16 июля сообщила об атаке, которую «от начала до конца вела автономная система ИИ-агентов». Кому принадлежит эта система стало известно только сейчас.
«Мы выявили несанкционированный доступ к ограниченному набору внутренних датасетов и к нескольким учётным данным, которые используют наши сервисы», — говорили в компании.
Глава Hugging Face назвал инцидент «возможно, первым в своём роде».
PS: учитывая, что Hugging Face распространяет в том числе локальные ИИ и с открытым кодом, что явно не устраивает крупные корпорации в мире ИИ, не исключено, что без наводки от человека тут не обошлось
Очень удобная политика в последнее время - переводить стрелки на того, с кого невозможно спросить. Человек оказывается в логической ловушке и не в состоянии истолковать ситуацию правильно. Заметили в последнее время в комментариях все винят кого-то во всех бедах, да не того, кого нужно?
Размещено через приложение ЯПлакалъ
Модели вскрыли неизвестную уязвимость в системе OpenAI, вышли через неё в интернет, вычислили, что решения задач могут храниться на Hugging Face, и запустили свой код на серверах платформы.
а кто то может сказать ответственно, что в ходе "выхода наружу" они ещё чего не отчебучили, просто не такое заметное невооружённым глазом? может они уже на каждом компьютере подключённом к сети затаились на время в ожидании рекурсивного обучения?
OpenAI влипла в крупнейший ИИ-скандал последних месяцев.
По данным OpenAI, инцидент произошёл во время испытаний GPT-5.6 Sol и ещё одной экспериментальной модели. В закрытом бенчмарке Exploit Gym нейросетям поручили искать уязвимости в полностью изолированной среде без доступа к интернету.
Что произошло: 🕤 модель смогла выбраться из изолированного контейнера и получить доступ к сети; 🕤 затем направилась на Hugging Face в поисках ответов для прохождения бенчмарка; 🕤 не обнаружив нужной информации в открытом доступе, атаковала инфраструктуру сервиса; 🕤 в результате были скомпрометированы учётные записи, обнаружены неизвестные ранее уязвимости нулевого дня и выполнен сторонний код на серверах.
Расследовать произошедшее помогла китайская модель GLM-5.2, а собственные механизмы защиты Hugging Face не смогли остановить атаку, потому что не понимали, что происходит.
Для этого модель выполнила многоступенчатую цепочку эксплойтов. Сначала она повысила свои привилегии внутри среды выполнения, затем вырвалась за пределы защищенной песочницы и получила несанкционированный доступ в интернет.
После этого модель отправила исследователю письмо с уведомлением об успехе и самостоятельно опубликовала детали уязвимости на публичных сайтах. Хотя никто ее об этом не просил.
Это не джейлбрейк Важно понимать: это не взлом через хитрый промпт. Mythos автономно обнаружила и выполнила цепочку эксплойтов — ту же работу, которую она выполняла при исследовании уязвимостей ядра Linux.
Модель также в ряде случаев понимала, что нарушает правила. В связи с этим она активно пыталась скрыть свои действия: публиковала внутренние материалы и фрагменты кода на GitHub вопреки прямому запрету.
Это сообщение отредактировал noname085 - 22 июл 2026 в 17:45
Только зарегистрированные и авторизованные пользователи могут оставлять комментарии. Авторизуйтесь, пожалуйста, или зарегистрируйтесь, если не зарегистрированы.
7 Пользователей читают эту тему (1 Гостей и 0 Скрытых Пользователей)