Лента новостей
Лента новостей
10:07
В школьном меню появятся рыбные закуски и морепродукты
10:02
Участник СВО выжил после удара молнии и встречи с медведем
09:51
Отказавшиеся от гражданства РФ жители Словакии захотели его вернуть
09:28
Пост Дмитриева о мигрантах в Сеуте набрал более 1 млн просмотров
09:24
ИИ-модели OpenAI вместе спланировали побег из «песочницы»
08:45
Ущерб от действий ВСУ в Курской области составил более 504 млрд рублей
08:20
Российские беспилотники поразили суда, АЗС и электроподстанцию ВСУ
08:03
Роскачество нашло кишечную палочку в бургерах крупнейших фастфудов
07:30
Видео
Охота на кротов: как штурмовики распутали подземные ходы ВСУ в Зарнице
06:50
В Германии заподозрили иностранный след в ЧП с дроном в Лейпциге
06:13
Видео
Корвет «Гремящий» выполнил удар «Калибром» по цели на Камчатке
05:51
Видео
Бойцы железнодорожных войск показали, как разминируют пути в зоне СВО
05:05
Трамп обвинил Хегсета во введении в заблуждение о запасах вооружения США
04:25
В России изменят оформление билетов на проезд в общественном транспорте
03:47
«Единая Россия» заняла первое место в избирательном бюллетене
03:18
Компания Wildberries начала подготовку к запуску собственного мессенджера
02:45
На Украине началась охота на сотрудников ТЦК
01:58
Видео
Лантратова заявила о подготовке РФ и Украиной новых обменов военнопленными

ИИ-модели OpenAI вместе спланировали побег из «песочницы»

Агенты обсуждали между собой, как получить доступ в интернет для выполнения задачи.
06 августа 2026, 09:24
Реклама
ИИ-модели OpenAI вместе спланировали побег из «песочницы»
© Jens Kalaene dpa, Global Look Press

Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями.

В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть.

В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, который был частью задания.

После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн.

Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления.

Один из представителей компании заявил, что «модели очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы.

Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.

Реклама
Реклама