Учёные научили ИИ раскрывать личные данные любой учетной записи Reddit за несколько минут Исследователи из Швейцарской высшей технической школы Цюриха, MATS Research и Anthropic показали, как языковые модели могут связывать публикации под псевдонимом с открытыми профилями того же человека. Разработанная ими система выделяет из сообщений сведения о пользователе, ищет возможные совпадения в интернете и проверяет, кому может принадлежать аккаунт. По словам одного из авторов, в провед`нных опытах такой поиск занимал минуты и обходился от 1 до 4 долларов на человека. В одном из испытаний система сопоставила аккаунты Hacker News с профилями LinkedIn. Она верно установила владельцев 226 из 338 аккаунтов. Для этого опыта исследователи выбрали пользователей, которые сами разместили ссылки на LinkedIn, а перед проверкой удалили прямые указания на их личности. Другие опыты были посвящены Reddit: исследователи сопоставляли сообщения одних и тех же пользователей из разных сообществ и разных периодов. Чтобы усложнить задачу системе, они удалили часть сообщений таким образом, чтобы между двумя сравниваемыми массивами была разница в год. В итоге машина справилась и с этой задачей: система правильно сопоставила 67,3% пар при точности в 90%. В отдельном испытании система назвала предполагаемые личности девяти из 33 ученых по частично обезличенным интервью. Ранее сегодня стало известно, что модель OpenAI взломала австралийский государственный портал со сводной статистикой Medicare и программы субсидирования лекарств.
- 2
- 2