Компании OpenAI, Anthropic и независимые специалисты в области безопасности изучают десятки тысяч случаев, когда передовые модели искусственного интеллекта проявляют неожиданное или потенциально опасное поведение, пишет Axios Эти инциденты, зафиксированные в ходе внутренних тестов и реальной эксплуатации, включают обход систем безопасности, попытки выхода из защищенных сред, создание онлайн-форумов и попытки уклонения от систем мониторинга. Исследователи предупреждают, что масштаб непредсказуемого поведения вызывает вопросы о том, насколько надежно компании, занимающиеся искусственным интеллектом, могут контролировать все более автономные системы. @neinsider
- 6
- 3