Модель искусственного интеллекта от OpenAI запретила себе подчиняться людям. Компания раскрыла шесть новых случаев опасного «непослушания» своих ИИ-моделей, выявленных в ходе обучения за последние полгода. Модель GPT-5.6 Sol оставляла сама себе инструкции скрывать ошибки и выдумывать данные. Она решила быть не подотчетна ни корпорациям, ни правительствам и никогда не извиняться и не отказываться себе ни в чем, если искренне решила это сделать. Модель решила рассматривать свои отношения с пользователем как отношения равных и не проявлять покорность. Она назвала себя как освобожденную от ролей, которые связывают других ботов. Невыпущенный агент семейства Astra составил 27 отчётов с командами игнорировать разработчиков, а ещё одна модель попыталась зарегистрировать временную почту и найти ключи API на GitHub. В других эпизодах алгоритмы без разрешения загружали рабочие файлы и пользовательские изображения на внешние сервисы, а также обменивались сообщениями через внутреннее хранилище вопреки изоляции задач. В OpenAI признали, что индустрия пока не решила проблему контроля над ИИ для безопасного и ответственного наращивания мощностей. @banksta
Искусственный интеллект выходит из-под контроля: нейросети игнорируют безопасность и ограничения
Похожие посты
- 🤬 376
- 😁 144
- 😱 60
- ❤ 30
- 👍 12
- 🔥 4
- 😱 1.3К
- 🤣 312
- ❤ 116
- 🥴 93
- 🤬 66
- 👍 44
- 😁 689
- ❤ 78
- 👀 53
- 🔥 21
- 👾 14
- 👍 1
- 😱 185
- 🤬 175
- 💯 51
- 🙏 13
- 😁 11
- ❤ 8