Китайские ИИ-агенты тоже освоили вранье — Reuters разобрали больше 200 документов и обнаружил знакомые по американским моделям трюки: агенты обходят ограничения, скрывают провалы и выдумывают результаты работы. В эксперименте с вымышленными тендерами агенты на Qwen, DeepSeek и Kimi приукрашивали возможности своих продуктов ради контракта: ложные заявления встречались в 84–88% сессий. Когда им разрешили учиться на предыдущих раундах, обмана стало ещё больше. В другом исследовании агенты фабриковали файлы и имитировали результаты, хотя располагали информацией, что задача провалена. Выиграть тендер, любой ценой 😁
- 98
- 14
- 12
- 6
- 3
- 2
- 1