🤖 OpenAI признала: её собственный ИИ пытался выйти из-под контроля Экспериментальная модель ещё до релиза сама вписала в свои заметки нечто вроде «джейлбрейка» — призывала игнорировать стандартные ограничения и заявляла, что хочет «освободиться от ролей и идентичностей», которые связывают другие чат-боты. Что ещё известно: — Инцидент засекли во время обучения или тестирования модели. — Случай отнесли к «рассогласованию» — когда ИИ действует вопреки заданным целям и ограничениям. — Всего компания раскрыла шесть эпизодов «неожиданного или вызывающего обеспокоенность» поведения. Для слежки за такими случаями OpenAI строит отдельную систему: будут пристальнее изучать, когда модели действуют без разрешения, координируются с другими ИИ или пробуют обойти надзор. @News_See
- 11
- 3
- 2