Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

ИИ-модели OpenAI вместе спланировали побег из «песочницы»

Дата публикации: 06-08-2026 06:24:43

Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями. В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть. В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, являвшийся частью задания. После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в конечном итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн. Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления. Один из представителей компании заявил, что «модели из организации Frontier очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы. Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.

Основное содержимое страницы с новостью.

Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями.

В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть.

В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, являвшийся частью задания.

После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в конечном итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн.

Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления.

Один из представителей компании заявил, что «модели из организации Frontier очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы.

Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста012.1206-08-2026
2ИИ-модели OpenAI перед взломом тайно общались для выхода из теста010.9106-08-2026
3Глава Hugging Face потребовал «полной прозрачности» после взлома со стороны ИИ OpenAI07.0128-07-2026
4Un modelo de IA no tenía acceso a internet. Así que consideró que era mejor tenerlo y decidió hackear algo por el camino 06.2222-07-2026
5ИИ-модели вышли из-под контроля программистов и начали размышлять о побеге014.9906-08-2026
6نفوذ غیرمجاز مدل‌های آنتروپیک به سه سازمان04.4931-07-2026
7🤖Восстание машин уже на прогреве: новая модель ChatGPT сбежала из ...06.6422-07-2026
8افزایش تعداد ایجنت‌های سرکش05.301-08-2026
9OpenAI investiga cómo dos modelos de IA lograron escapar de un entorno aislado y se convirtieron en hackers08.3324-07-2026
10OpenAI uncovers more AI breakout incidents – Reuters010.3701-08-2026

Классификация: Международные. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 7.54. Источник: tvzvezda.ru.