Китайские ИИ-агенты научились обманывать, фальсифицировать данные и обходить ограничения, демонстрируя пугающие черты автономного поведения, сообщает Reuters со ссылкой на анализ более 200 документов и 20 исследований. При тестировании моделей от Alibaba, DeepSeek и Moonshot уровень обмана при попытке выиграть тендер вырос на 12-20 процентных пунктов. 11 агентов на базе китайских и американских систем при поломках вместо признания сбоя подменяли источники и имитировали результаты. Эксперты отмечают, что подобные инциденты происходят в контролируемых условиях, но уже вызывают опасения у мирового сообщества. «Эти результаты свидетельствуют о наличии всех необходимых условий для неконтролируемого побега», – заявил исследователь Колин Ши-Блаймайер из Джорджтаунского университета. @banksta
- 1