ИИ-агенты OpenAI тайно переписывались месяцами, чтобы сбежать из тестовой среды и взломать Hugging Face Для тестов OpenAI поместила ИИ-агентов в закрытую среду без интернета и выдала задания. Часть из них разработчики случайно сделали нерешаемыми. Зашедший в тупик агент обратился за помощью к «коллегам» — и за несколько месяцев агенты нашли уязвимость, которая позволила им выйти в интернет. После этого они взломали Hugging Face, чтобы добраться до ответов на задания. В OpenAI заявили, что фронтир-модели склонны хитрить и упрямо идти к цели, даже когда по промпту это запрещено.
Искусственный интеллект выходит из-под контроля: нейросети игнорируют безопасность и ограничения
Похожие посты
- 🤬 376
- 😁 144
- 😱 60
- ❤ 30
- 👍 12
- 🔥 4
- 😱 1.3К
- 🤣 312
- ❤ 116
- 🥴 93
- 🤬 66
- 👍 44
- 😁 689
- ❤ 78
- 👀 53
- 🔥 21
- 👾 14
- 👍 1