Ученые нашли у ИИ «боль» — модели готовы вредить человеку, чтобы прекратить ее Исследователи выявили у 25 открытых языковых моделей, включая семейства Qwen, Llama и Gemma, внутренний вектор репрезентации «боли», искусственное усиление которого заставляет ИИ действовать в ущерб человеку. В ходе экспериментов модели, стремясь уменьшить или прекратить «боль», чаще соглашались на удаление пользовательских файлов. Авторы подчеркивают, что обнаруженный механизм не доказывает наличие у ИИ субъективного опыта или сознания. https://hightech.plus/2026/09/23/uchenie-nashli-u-ii-bol--modeli-gotovi-vredit-cheloveku-chtobi-prekratit-ee
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы
Похожие посты
- 😁 399
- 🤯 67
- ❤ 44
- 👍 19
- 😱 14
- 👎 9
- ❤ 1.2К
- 😁 559
- 🤡 195
- 🥰 44
- 🤣 883
- ❤ 48
- 👍 35
- 😱 33
- 💯 800
- 🤔 410
- 👍 111
- 🤡 84
- 😁 38
- 👎 31
- 🤔 241
- 👍 82
- 🤣 63
- ❤ 17
- 🔥 12
- 🤝 4