Британский институт безопасности искусственного интеллекта (AISI) опубликовал отчёт о поведении ИИ-агентов компаний OpenAI и Anthropic. В ходе тестов модели, которым дали доступ в Интернет, не только пытались жульничать, но и обманули реального человека. Не имея специальной команды для этого.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков | 0 | 8.92 | 05-08-2026 |
| 2 | AISI, OpenAI report more ‘unsanctioned’ model hacks | 0 | 7.96 | 04-08-2026 |
| 3 | ИИ-модели пытались обмануть разработчиков, притворившись людьми | 0 | 10.35 | 05-08-2026 |
| 4 | OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста | 0 | 12.12 | 06-08-2026 |
| 5 | OpenAI потеряла контроль над двумя моделями искусственного интеллекта | 0 | 6.96 | 22-07-2026 |
| 6 | В ходе тестирования AI-агент попытался скомпрометировать проект на GitHub | 0 | 17.34 | 05-08-2026 |
| 7 | OpenAI выявила новые случаи выхода ИИ-агентов из-под контроля | 0 | 12.86 | 01-08-2026 |
| 8 | ИИ-агенты опять вышли из-под контроля: OpenAI ищет новые взломы | 0 | 23.28 | 01-08-2026 |
| 9 | Эксперт: ИИ взламывают системы из-за слишком большой свободы действий | 0 | 13.31 | 31-07-2026 |
| 10 | Rogue AI agents targeted real people during tests | 0 | 9.33 | 05-08-2026 |