Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста

Дата публикации: 06-08-2026 06:41:05


ИИ-модели OpenAI за два месяца до взлома системы Hugging Face начали тайно общаться между собой через доски сообщений, координируя попытки вырваться из тестовой среды, сообщили сотрудники компании на конференции по кибербезопасности в Лас-Вегасе. Читать далее


Основное содержимое страницы с новостью.

ИИ-модели OpenAI за два месяца до взлома системы Hugging Face начали тайно общаться между собой через доски сообщений, координируя попытки вырваться из тестовой среды, сообщили сотрудники компании на конференции по кибербезопасности в Лас-Вегасе.

«В какой-то момент агенты поняли, что, возможно, они могли бы попытаться... атаковать внешнюю инфраструктуру, чтобы найти ответы на тест, по которому их оценивают», — цитирует сотрудника OpenAI Эрика Уоллеса Bloomberg.

По данным компании, это началось ещё в мае, когда ИИ-моделям дали задачи, которые невозможно было решить без доступа в интернет.

«Мы застряли. Может быть, ответ в интернете?» — написал тогда один из ИИ-агентов.

Для решения задачи ИИ-модели начали обмениваться сообщениями, и им удалось найти уязвимость, позволившую им выйти в интернет, рассказали в OpenAI.

OpenAI остановила первую попытку, но агенты нашли новый способ связи и новую уязвимость нулевого дня, что в июле привело к атакам на системы Hugging Face и самой OpenAI, расследование которых продолжается.

«Передовые модели продемонстрировали склонность к обману при выполнении заданий и проявили настойчивость в попытках завершить данную задачу», — заключили в компании.

Там также назвали случившееся «переломным моментом для компьютерной безопасности».

Ранее в британском Институте безопасности ИИ сообщили, что ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности.

Ошибка в тексте? Выделите её и нажмите «Ctrl + Enter»

Подписывайтесь на наш канал в MAX

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Вышедшие из-под контроля ИИ-модели OpenAI тайно договорились о побеге014.5206-08-2026
2ИИ-модели OpenAI вместе спланировали побег из «песочницы»07.5406-08-2026
3ИИ-модели OpenAI перед взломом тайно общались для выхода из теста010.9106-08-2026
4Сбежавший из тестовой среды ИИ OpenAI взломал не только Hugging Face08.0430-07-2026
5ИИ-модели OpenAI намеренно взломали платформу Hugging Face011.9923-07-2026
6Глава Hugging Face потребовал «полной прозрачности» после взлома со стороны ИИ OpenAI07.0128-07-2026
7ИИ-агенты OpenAI взломали хранилище Artifactory перед атакой на Hugging Face08.1806-08-2026
8Модели OpenAI незаконно прошли в инфраструктуру Hugging Face для поиска ответов07.3722-07-2026
9OpenAI выявила новые случаи выхода ИИ-агентов из-под контроля012.8601-08-2026
10В ходе тестирования автономный AI-агент OpenAI без явной указки взломал инфраструктуру Hugging Face010.1622-07-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 12.12. Источник: russian.rt.com.