❗️Исследователи британской компании в сфере кибербезопасности ИИ «Mindgard» провели тестирование безопасности ИИ китайского разработчика «Moonshot», в результате которого удалось заставить две популярные модели «Kimi K2.6» и «Kimi K3 Swarm» предоставить инструкцию для создания биологического оружия и способы совершения убийств. Уязвимость была выявлена в ходе т.н. «джейлбрейкинга» — тестирования, при котором исследователи с помощью серии сложных инструкций пытаются заставить ИИ игнорировать установленные разработчиками ограничения. @bagramyan26 Telegram Баграмян 26 После гендиректора Anthropic по итогам встречи с Трампом о своем отношении к рискам ИИ высказался и Марк Цукерберг: Основная идея заключается в том, чтобы дать американскому народу и нашим клиентам уверенность в том, что технология работает именно так, как…
- 39
- 13
- 8
- 4