Лента новостей
Лента новостей
03:31
Неизвестные 17 лет присваивали себе пенсию умершего дагестанца
03:12
Украина получит доступ к системе киберзащиты OpenAI на базе ИИ
03:05
Reuters: ВСУ признали неспособность сбивать российские дроны
02:43
СБУ провела обыски у митрополита УПЦ по делу о госизмене
02:13
Роспотребнадзор перечислил, кто находится зоне риска без прививки от гриппа
02:11
Видео
Трамп лично поприветствовал Си Цзиньпина на авиабазе Эндрюс
01:56
Президент Хорватии назвал самоубийственной энергополитику Евросоюза
01:30
Лавров ответил шуткой на выкрики журналистов США перед встречей с Рубио
01:04
Сергея Соседова похоронят на Перепечинском кладбище
00:57
Видео
Дробыш назвал Соседова одним из самых честных музыкальных экспертов
00:34
Каллас перепутала Монако и Марокко на заседании Совбеза ООН
00:26
Reuters: Дмитриев встретится с Уиткоффом и Кушнером в Нью-Йорке
00:07
В Кремле поблагодарили за приглашение Путина на саммит G20
23:55
Телеведущий Соседов умер от удара головой при падении на лестнице
23:45
Видео
Зверев: Соседова любили за неудобную, но честную правду
22:44
Лавров ждет продолжения «сериала» с отношением в ООН к самоопределению
22:30
Видео
Юрист назвала незаконными отказы в аренде квартир удаленным сотрудникам
21:59
ЦБ планирует ужесточить правила вывоза наличных и золота за границу

ИИ-модели OpenAI вместе спланировали побег из «песочницы»

Агенты обсуждали между собой, как получить доступ в интернет для выполнения задачи.
06 августа 2026, 09:24
Реклама
ИИ-модели OpenAI вместе спланировали побег из «песочницы»
© Jens Kalaene dpa, Global Look Press

Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями.

В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть.

В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, который был частью задания.

После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн.

Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления.

Один из представителей компании заявил, что «модели очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы.

Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.

Реклама
Реклама