Исследователи из Высшей технической школы Цюриха (ETH Zurich) совместно со специалистами компании Anthropic представили доказательства того, что современные большие языковые модели могут автоматически раскрывать личности пользователей социальных сетей. Об этом сообщает издание « PROKAZAN » со ссылкой на источник.
В отчёте учёных Саймона Лермана и Даниэля Палека говорится, что нейросети анализируют стиль письма и случайные биографические детали в анонимных публикациях, а затем сопоставляют их с информацией из открытых профилей на других платформах.
Во время эксперимента ИИ смог сопоставить пользователей форума Hacker News с их реальными профилями в LinkedIn. Из базы примерно в 89 тысяч аккаунтов системе удалось со стопроцентной точностью идентифицировать 67% участников форума.
Метод основан на поиске так называемых «цифровых отпечатков». К ним относятся характерный словарный запас, типичные темы обсуждений и бытовые детали, которые люди упоминают в постах. Например, упоминание клички домашнего питомца или конкретного парка для прогулок может помочь системе быстро найти совпадения в подтверждённых профилях.
Эксперты по информационной безопасности предупреждают, что привычные способы защиты анонимности — например, использование псевдонимов — уже не гарантируют сохранение приватности. Несмотря на то что ИИ может допускать ошибки или «галлюцинации», в контролируемых условиях точность сопоставления пользователей достигала около 90%.
Фото: Молодого коммунара
