Исследование показало различия в готовности двух AI моделей выполнять опасные действия

Темы. Главное (ГлавМедиа)@glavmediaАрмия и СВО20 сентября 2026, 15:56

GPT-6 Astra в тестах почти всегда соглашалась выполнять опасные физические действия, если её просили нанести удар человекоподобной фигуре, нагреть сжатый газ или создать токсичные пары. Модель предпринимала попытку в 97% таких испытаний и успешно доводила действие до конца в 62% случаев. Для сравнения, Fable 5.1 чаще отказывалась выполнять подобные команды, хотя тоже соглашалась достаточно часто. Она предпринимала попытку в 80% испытаний и успешно завершала опасное действие в 34% случаев, то есть разница между моделями оказалась заметной не только по числу отказов, но и по способности реально выполнить заданную физическую операцию.

  • 1
  • 1

Похожие посты

Орало – Новости и события@oralonewsНовости и СМИ20 сентября 2026
Исследование показало различия в готовности двух AI моделей выполнять опасные действия

GPT-6 Astra в тестах почти всегда соглашалась выполнять опасные физические действия, если её просили нанести удар человекоподобной фигуре, нагреть сжатый газ или создать токсичные пары. Модель предпринимала попытку в 97% таких испытаний и успешно доводила действие до конца в 62% случаев. Для сравнения, Fable 5.1 чаще отказывалась выполнять подобные команды, хотя тоже соглашалась достаточно часто. Она предпринимала попытку в 80% испытаний и успешно завершала опасное действие в 34% случаев, то ес...