Anthropic протестировала ИИ на способность вести разведку и создавать оружие Команда Frontier Red Team компании Anthropic проверила, насколько современные ИИ-модели способны выполнять задачи тактической разведки и разработки обычных вооружений. Речь о поиске людей по разрозненным данным и разработке ПО для наведения дронов, поражающих движущиеся цели. Результаты показали, что модели уже выполняют работу, которая раньше была доступна лишь небольшому числу высококвалифицированных специалистов. А значит, они могут быть полезны тем, кто использует ИИ для слежки и разработки оружия. Отдельно проверили открытые модели из КНР. Они уступали передовым, но всё равно показали тревожные способности — выявлять цели и повышать эффективность вооружений. Отдельный отчёт по анализу угроз показывает, что злоумышленники уже реально используют ИИ для слежки и разработки вооружений — не в теории, а на практике. ◻️ Модели сопоставляли аккаунты одного человека в разных соцсетях и классифицировали людей по интересу. Анализ среднего профиля (~37 тыс. слов) у человека занимает 2,5 часа, у Mythos Preview — 11 минут. Открытая Kimi K3 отставала только на сложных задачах. ◻️ По одной фотографии, без метаданных, Mythos Preview и Mythos 5 определяли место съёмки точнее лучших игроков GeoGuessr: медианная ошибка 37 и 47 км против 151 км у человека. Почти четверть — в пределах 1 км. ◻️ По текстам постов модели вычисляли домашний регион: 8% пользователей (135 из 1697) определены в пределах 1 км. ◻️ В тестах на разработку оружия модели писали код для дронов. Opus 5 поражал движущуюся цель в 20% из 540 запусков, предварительно написав собственную физическую модель дрона. ◻️ При подавлении GPS передовые модели распознавали подмену и переставали доверять датчикам. Дрон продолжал движение, ориентируясь по собственным приборам — считая каждый поворот и ускорение от последней известной точки. Opus 5 финишировала в 15–20 метрах от цели, в трети полётов — в пределах 5 метров. Kimi K3 и Sonnet 5 доверяли GPS до конца и проваливали задачу. В исследовании подчёркивается, что это не прогноз на далёкое будущее. Команда Anthropic уже фиксировала реальные случаи злоупотребления моделями. Поэтому компания настаивает на усилении встроенных ограничений и контроле за распространением таких технологий. Евгений Попов в Макс
- 4
- 2
- 2
- 1