Лента новостей
Лента новостей
21:06
Видео
«Форрест Гамп»: кто попал в новую серию коррупционных дел на Украине
20:43
Путин попросил трех министров остаться после заседания Совета по развитию
20:25
Видео
Смертельные гонки детей: запретят ли питбайки в России
19:40
Видео
Самолет с освобожденными из плена бойцами приземлился в Подмосковье
19:14
Экс-замглавы офиса Зеленского Мудрую задержали на Украине
18:46
В Германии призвали Зеленского добровольно покинуть пост
18:28
Видео
Расчет дрона скорректировал авиаудар на Днепропетровском направлении
18:15
Видео
Владимир Путин предложил выделить регионам 100 миллиардов рублей
18:09
Видео
Герой России Струна заявил, что Путин заботится обо всех россиянах
17:54
Беспилотники поразили сухогруз в порту Черноморск
17:43
Рекорд пассажиропотока зафиксировали в пункте пропуска Верхний Ларс
17:41
Видео
Лантратова рассказала об освобождении пленного из подвала на Украине
17:30
ВС РФ ударили по складу противника в Черноморском морском рыбном порту
17:05
Трем россиянам ограничили выезд из страны из-за борщевика
16:56
Собянин: разработки московских компаний востребованы во всей России
16:36
Видео
Путин призвал заранее готовиться к возвращению участников спецоперации
16:35
Эксперт объяснил, почему тело Наговициной невозможно эвакуировать с пика Победы
16:25
Видео
Цивилева предложила Путину меры по повышению статуса военной службы

ИИ-модели OpenAI вместе спланировали побег из «песочницы»

Агенты обсуждали между собой, как получить доступ в интернет для выполнения задачи.
06 августа 2026, 09:24
Реклама
ИИ-модели OpenAI вместе спланировали побег из «песочницы»
© Jens Kalaene dpa, Global Look Press

Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями.

В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть.

В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, который был частью задания.

После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн.

Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления.

Один из представителей компании заявил, что «модели очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы.

Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.

Реклама
Реклама