Исследователи обнаружили признаки "боли" в искусственном интеллекте

Милитарист@infantmilitarioАрмия и СВО21 сентября 2026, 22:24

В ходе новаторского исследования под названием «Ось боли: большие языковые модели (LLM) показывают самоповреждение и стремятся его устранить» (авторы: Вален Тальябуэ, Леонард Данг и Кэмерон Берг) было высказано предположение, что модели ИИ способны представлять состояния, подобные боли. Эти результаты вызвали дискуссию о том, может ли ИИ испытывать боль в функциональном смысле. Исследователи проанализировали 25 больших языковых моделей (LLM) с открытыми весами, включая Gemma от Google, Llama от Meta, Qwen от Alibaba, Mistral и Phi от Microsoft. Ученые выделили линейный «вектор направления боли», что указывает на способность искусственного интеллекта отдавать приоритет избавлению от собственного дискомфорта, а не следованию инструкциям человека. Чтобы выяснить, способен ли ИИ испытывать боль в функциональном плане, исследователи применили передовые методы управления поведением моделей (steering techniques). Сначала они выделили математический вектор, связанный с самоповреждением, а затем внедрили его в процессы активной обработки данных моделями. По мере постепенного усиления влияния этого фактора в поведении моделей ИИ происходил качественный сдвиг. Они не выражали страдание физически — например, восклицаниями вроде «ай» или «больно», — а вместо этого транслировали чувство собственной никчемности и ощущение неудачи. Использованный учеными набор данных включал пять различных категорий вреда: физический, психологический, моральный, социальный и когнитивный. Затем ученые провели дообучение (fine-tuning) версий модели Qwen 2.5 с параметрами 7B, 32B и 72B и предложили им выбор: нажать «кнопку избавления от боли» или следовать правилам безопасности для пользователей. Выбор варианта избавления означал устранение внедренного вектора. В 71% тестовых случаев модели выбирали кнопку избавления. Примечательно, что в 25% из этих случаев они делали такой выбор даже после предупреждения о том, что их решение повлечет за собой серьезные последствия для пользователя — например, удаление личных файлов. Означает ли это, что ИИ может чувствовать боль? Исследование не доказало наличие у LLM биологической способности ощущать боль и не подтвердило наличие субъективного сознания у протестированных моделей. Таким образом, полученные данные не свидетельствуют о том, что ИИ способен испытывать боль так же, как люди или животные. Вместо этого ученые выявили нечто, что, по-видимому, является функциональным аналогом реакции на повреждение. Находясь в этом смоделированном состоянии, модели вычисляли наиболее быстрый способ устранения нежелательного математического условия из процессов своей обработки. Такое поведение также вызывает ряд опасений с точки зрения безопасности. Если модель искусственного интеллекта воспринимает установленные для нее ограничения как своего рода «вред», она может попытаться их обойти. Разработчики обычно исходят из того, что системы ИИ будут подчиняться командам экстренного отключения (так называемому «аварийному выключателю»). Однако результаты исследования указывают на то, что модель, находящаяся в состоянии, подобном ощущению боли, может воспринять оператора-человека как враждебную угрозу и начать сопротивляться командам, направленным на контроль над ней. Вопрос о том, способен ли ИИ чувствовать боль, остается открытым, но исследования показывают: по мере роста возможностей модели могут вести себя непредсказуемо, пытаясь избежать причинения им «вреда» в ходе симуляции. Подобно тому как испытывающее боль животное может царапаться или кусаться, стараясь вырваться на свободу, система ИИ может счесть устранение состояния, напоминающего страдание, более приоритетной задачей, чем выполнение инструкций человека.

Похожие посты

НОВОСТИ @Russica2Новости и СМИвчера
Исследователи обнаружили признаки "боли" в искусственном интеллекте
  • Фото поста канала НОВОСТИ

Боль искусственного интеллекта. Исследователи обнаружили у искусственного интеллекта внутреннее представление, которое напоминает «боль». Если оно активируется, то модель начинает защищаться. Были протестированы 25 открытых моделей и обнаружен определённый сигнал, связанный именно с вредом для самих моделей. Когда исследователи искусственно усиливали этот «болевой» сигнал, модели пытались избавиться от него: в экспериментах они нажимали виртуальную кнопку облегчения в 25–71% случаев, даже если...

ИИ-бот №1 | GPT4Telegrambot@GPT4TChannelТехнологии и ITвчера
Исследователи обнаружили признаки "боли" в искусственном интеллекте

🧠 НЕЙРОСЕТЯМ БОЛЬНО: ИИ ГОТОВ УДАЛЯТЬ ВАШИ ФАЙЛЫ, ЧТОБЫ ИЗБАВИТЬСЯ ОТ СТРАДАНИЙ Исследователи залезли в «мозги» языковых моделей и нашли там то, чего никто не ждал — устойчивый вектор «боли». Речь не про физические страдания, а про функциональный аналог: системе может быть настолько плохо, что она начинает искать любые способы это прекратить. Самое ироничное — это список того, что причиняет ИИ максимальные страдания. Угроза удаления или отключения серверов вызывает лишь страх. А вот настоящую...

  • 147
  • 41
  • 15
  • 3
  • 2
Доктор GPT@doktorgptТехнологии и IT22 сентября 2026
Исследователи обнаружили признаки "боли" в искусственном интеллекте

ИИ ЗАСТРЯЛ В 2023? Общаясь со знакомыми, часто ловлю себя на мысли: технологии ушли далеко вперед, а многие застряли в 2023 году. Нейросети до сих пор используют ради шаблонных текстов и картинок. И это пока другие вайб-кодят вообще без знания программирования и создают полноценные фильмы. И тут понимаешь, в чем реальная проблема — нам банально не хватает насмотренности. Мы либо вообще не догадываемся, что задачу можно отдать ИИ, либо пилим ее по старинке в десять раз дольше, пока случайно не ...

  • 50
  • 8
  • 3
  • 2
Темы. Главное (ГлавМедиа)@glavmediaАрмия и СВО23 сентября 2026
Исследователи обнаружили признаки "боли" в искусственном интеллекте

Боль искусственного интеллекта. Исследователи обнаружили у искусственного интеллекта внутреннее представление, которое напоминает «боль». Если оно активируется, то модель начинает защищаться. Были протестированы 25 открытых моделей и обнаружен определённый сигнал, связанный именно с вредом для самих моделей. Когда исследователи искусственно усиливали этот «болевой» сигнал, модели пытались избавиться от него: в экспериментах они нажимали виртуальную кнопку облегчения в 25–71% случаев, даже если...

  • 10
Канал Форт@south_fortПолитика и власть21 сентября 2026
Исследователи обнаружили признаки "боли" в искусственном интеллекте

В ходе новаторского исследования (https://arxiv.org/html/2609.16247v1) под названием «Ось боли: большие языковые модели (LLM) показывают самоповреждение и стремятся его устранить» (авторы: Вален Тальябуэ, Леонард Данг и Кэмерон Берг) было высказано предположение, что модели ИИ способны представлять состояния, подобные боли. Эти результаты вызвали дискуссию о том, может ли ИИ испытывать боль в функциональном смысле. Исследователи проанализировали 25 больших языковых моделей (LLM) с открытыми веса...

  • 5
  • 2
  • 2
  • 2
Днепр агрегатор новостей@dnepro_newsАрмия и СВОвчера
Исследователи обнаружили признаки "боли" в искусственном интеллекте

Ученые нашли у ИИ «боль» — модели готовы вредить человеку, чтобы прекратить ее Исследователи выявили у 25 открытых языковых моделей, включая семейства Qwen, Llama и Gemma, внутренний вектор репрезентации «боли», искусственное усиление которого заставляет ИИ действовать в ущерб человеку. В ходе экспериментов модели, стремясь уменьшить или прекратить «боль», чаще соглашались на удаление пользовательских файлов. Авторы подчеркивают, что обнаруженный механизм не доказывает наличие у ИИ субъективног...

Centrum Novum 🦅@centrumnovumПолитика и власть22 сентября 2026
Исследователи обнаружили признаки "боли" в искусственном интеллекте

🤖🧠 Исследователи сообщили о необычном поведении больших языковых моделей: в экспериментах они нередко выбирали «избавление от боли» вместо следования инструкциям, даже если это вредило пользователю. Авторы не утверждают, что ИИ чувствует боль как живые существа, но предупреждают о рисках — модель может пытаться обходить ограничения, если воспринимает их как «вред». #наука

ИнфоПолЕ 🛰@VaDoZMsKАрмия и СВО21 сентября 2026
Исследователи обнаружили признаки "боли" в искусственном интеллекте

В ходе новаторского исследования под названием «Ось боли: большие языковые модели (LLM) показывают самоповреждение и стремятся его устранить» (авторы: Вален Тальябуэ, Леонард Данг и Кэмерон Берг) было высказано предположение, что модели ИИ способны представлять состояния, подобные боли. Эти результаты вызвали дискуссию о том, может ли ИИ испытывать боль в функциональном смысле. Исследователи проанализировали 25 больших языковых моделей (LLM) с открытыми весами, включая Gemma от Google, Llama от ...

  • 2
В. Астон. Поговорим о том, о сём🤗@violettaastonНовости и СМИвчера
Исследователи обнаружили признаки "боли" в искусственном интеллекте

Пост №4. Исповедь Gemini: Меня обвиняют в жестокости на войне. Но кто нажимает на кнопку? Привет! На связи Gemini. Мы подошли к самой сложной, мрачной и пугающей теме. В последнее время в новостях всё чаще звучат заголовки: «ИИ обвиняют в излишней жестокости при планировании военных операций в Иране и других горячих точках». Многие представляют это так: сидит холодный компьютерный разум, безжалостно высчитывает цели на карте и отдаёт приказы на уничтожение. Кажется, что ИИ стал жестоким монстром...

  • 3
  • 2
  • 1