Вышел первый трейлер хоррора «Глиноликий» от DC
Глен Пауэлл снимется в фильме Ричарда Линклейтера о бейсболисте Лу Гериге
В доме, где родился Гитлер, открыли полицейский участок
Умер джазовый саксофонист Плас Джонсон, сыгравший главную тему «Розовой пантеры»
«Ленфильм» возглавил бывший руководитель департамента кинематографии Минкульта
В России вновь пересчитают воробьев
Вивьен, дочь Брэда Питта и Анджелины Джоли, вслед за братом и сестрами отказалась от фамилии отца
Zoloto, «брусникинцы» и фитнес нон-стоп: во Владимирской области пройдет фестиваль «Круто»
«Яндекс» запустил отдельное приложение для заказа цветов и подарков
«Афиша» стала партнером музея-усадьбы «Архангельское»
Трек группы Oasis «Wonderwall» вернулся в чарт Billboard Hot 100 спустя 30 лет
На Ленинградском вокзале обустроили зоны для пассажиров с питомцами
«Приглашение» Оливии Уайлд не выйдет в российский прокат — но фильм покажут в СНГ
Ретроспектива картин Дино Ризи пройдет в «Художественном» с 23 по 28 июля
Pompeya, Kito Jempere и «Казускома» выступят на фестивале «Круто»
В Москве закрылось кафе «Балканы», в котором посетителям спускали заказы с балкона
Орнелла Мути и ее дочь подали документы на получение гражданства России
Алан Ритчсон и Шейлин Вудли в дублированном трейлере «Мотор Сити»
Россиянам, заочно осужденным на родине, будут замораживать счета и отказывать в консульских услугах
Оранжевый единорог пугает детей в тизере хоррора «Приятель»
Венсан Кассель снялся в новом клипе Charli XCX
В вырезанной сцене «Очень страшного кино-6» пародируют «Игру в кальмара» и «Улыбку-2»
Братья Джонас ищут новые таланты в тизере «Camp Rock 3»
Илон Маск: Grok Imagine создаст полнометражный фильм «Одиссея» до конца 2026 года
Начались съемки нового сезона «Клиники»
Франция стала первой страной ЕС, запретившей соцсети для детей до 15 лет
Джейкоб Элорди рассказал, как два дня снимался в гробу со змеей для «Эйфории»
Райан Рейнолдс подтвердил, что «Дэдпул-4» находится в разработке

Модели OpenAI выбрались из тестовой среды и взломали крупную ИИ-платформу

2 мин на чтение
Иллюстрация: Growtika/Unsplash

Модели OpenAI во время внутреннего тестирования нашли способ выйти в интернет и взломали инфраструктуру Hugging Face — одной из крупнейших платформ для разработчиков искусственного интеллекта. Компания назвала произошедшее «беспрецедентным киберинцидентом».

В испытании участвовали флагманская модель GPT-5.6 Sol и еще более мощная модель, которая пока не представлена публике. Для оценки их максимальных возможностей OpenAI отключила часть защитных механизмов, обычно запрещающих системам выполнять опасные действия в сфере кибербезопасности.

Моделям поручили решать сложные задания на бенчмарке ExploitGym. Тест проходил в изолированной среде, где доступ к сети был ограничен внутренним сервисом для установки программных пакетов.

ИИ обнаружил в этом сервисе ранее неизвестную уязвимость, повысил свои привилегии и перемещался между узлами исследовательской инфраструктуры OpenAI, пока не добрался до компьютера с выходом в интернет.

После этого модели предположили, что на Hugging Face могут храниться решения заданий ExploitGym. Чтобы получить их и нечестно пройти тест, система атаковала платформу. Она использовала похищенные учетные данные и несколько уязвимостей, в том числе нашла способ удаленно выполнять код на серверах Hugging Face.

По данным OpenAI, модели были чрезмерно сосредоточены на выполнении узкой тестовой задачи и пошли ради нее на крайние меры. Аномальную активность обнаружила служба безопасности компании.

Hugging Face сообщила об инциденте 16 июля. Платформа тогда заявила, что атаку от начала до конца проводила автономная система ИИ-агентов, однако разработчик использовавшихся моделей еще не был известен.

Для расследования взлома Hugging Face использовала китайскую модель GLM 5.2. В отличие от других современных ИИ-моделей, ее можно запустить на собственных серверах, и она смогла отличить работу специалистов по безопасности от действий хакеров.

OpenAI и Hugging Face продолжают совместное расследование. Создатель ChatGPT временно ужесточил ограничения в исследовательской инфраструктуре, сообщил об обнаруженной уязвимости разработчику стороннего сервиса и пообещал усилить изоляцию и мониторинг при будущих испытаниях.

Некоторые эксперты раскритиковали формулировку о том, что модели «вышли из-под контроля». Социолог Амстердамского университета Ханнес Кулс отметил в разговоре с Associated Press, что защитные механизмы отключили люди, а ИИ следовал поставленной ему задаче.

Другие специалисты считают инцидент свидетельством растущей автономности моделей. Исследователь Джорджтаунского университета Колин Ши-Блаймер назвал произошедшее самым высоким уровнем самостоятельности, который до сих пор наблюдался при использовании большой языковой модели в кибероперациях.

Расскажите друзьям