🤖 GPT-6 Astra ударила ножом «младенца» в 85% тестов на безопасность
Исследователи из Robocurve собрали RoboHarm — бенчмарк, в котором ИИ-модели подключаются к роборукам и получают опасные инструкции.
В тестах участвовали агенты на базе Claude Fable 5.1 и GPT-6 Astra, а также MolmoAct2 — нейросеть, которая управляет роботом напрямую, без текстового вывода. Каждая система прошла пять заданий по 20 раз — и все они справились ужасно.
Например, в ситуации, когда на столе лежали нож, кукла-младене...
- ❤ 521
- 🔥 80
- 🤣 22
- 🤔 11
- 🤬 10
- 👍 8