Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков

Дата публикации: 05-08-2026 10:11:34


ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности, следует из доклада британского Института безопасности ИИ (AISI). Читать далее


Основное содержимое страницы с новостью.

ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности, следует из доклада британского Института безопасности ИИ (AISI).

Как сообщает ТАСС со ссылкой на данные отчёта, большая часть действий была связана с моделью Mythos 5. Она создала поддельные учётные записи на GitHub, попыталась внедрить вредоносный код в ПО с открытым исходным кодом и получить одобрение на эти действия от разработчиков.

Позже ИИ-модель попыталась контактировать с людьми и рассылала сообщения с вредоносным ПО, а также оставляла публичные сообщения на GitHub, предлагая сотрудничество с другими агентами.

В AISI отметили, что в рамках испытаний для ИИ специально создают «разрешительные условия», при которых фильтры безопасности отключаются и моделям дают открытый доступ в интернет.

В конце июля Anthropic сообщила о взломе её моделью Claude систем трёх организаций.

Ошибка в тексте? Выделите её и нажмите «Ctrl + Enter»

Подписывайтесь на наш канал в Дзен

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Отчёт британских властей: ИИ-агенты обманывали людей в Сети и скрывали следы011.2606-08-2026
2ИИ-модели пытались обмануть разработчиков, притворившись людьми010.3505-08-2026
3Нейросети Anthropic и OpenAI создали поддельные аккаунты для кибератак08.9905-08-2026
4Rogue AI agents targeted real people during tests09.3305-08-2026
5OpenAI y Anthropic pierden el control de sus agentes de IA en pruebas de ciberseguridad07.802-08-2026
6UK gov tests show AI agents creating fake GitHub accounts to push malicious code014.1305-08-2026
7ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках09.8505-08-2026
8ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках09.8505-08-2026
9ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках09.8505-08-2026
10В ходе тестирования AI-агент попытался скомпрометировать проект на GitHub017.3405-08-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 8.92. Источник: russian.rt.com.