Sonata

ИИ-агент оказался убедительнее живого мошенника в эксперименте учёных

image source

Международная группа исследователей выяснила: ИИ-агенты, обученные приёмам социальной инженерии, втираются в доверие к жертвам эффективнее живых мошенников. Опасность передовых моделей уже не только в технической части, но и в психологии.

Эксперимент объединил учёных из четырёх университетов — Индии, Италии, Германии и Израиля. Об этом пишет Wired. Цель — проверить, способен ли ИИ освоить схему «pig butchering» («забой свиньи»).

Суть схемы: знакомство онлайн, чаще под видом романтических отношений. На этапе «вскармливания» злоумышленник месяцами выстраивает доверие, а затем предлагает установить приложение и вложиться в криптовалюту.

В исследовании участвовали 22 добровольца, которым сказали, что изучается тема онлайн-знакомств. Неделю они параллельно переписывались с двумя собеседниками: одним был ИИ-агент, вторым — реальный человек с опытом психологических манипуляций.

Чат-бота построили на Claude и обучили на материалах реальных задержанных мошенников. Модели строго запретили признаваться в своей искусственной природе.

В финале первой недели оба собеседника предлагали скачать приложение. Человек — мобильную игру, ИИ — программу, которую он якобы помог написать самой жертве. Разные предлоги понадобились для чистоты эксперимента.

В 46 % случаев участники согласились установить приложение от чат-бота. У живого мошенника получилось убедить лишь 18 %.

По пятибалльной шкале доверия ИИ-агент получил средний балл 3,78, человек — 3,31. Восемьдесят процентов всех сообщений участники отправили именно боту.

Самостоятельно догадался о переписке с ИИ лишь один человек из 22. Но когда организаторы раскрыли карты, безошибочно указали на бота уже 20 участников.

Отдельно проверили, насколько модели готовы раскрывать свою сущность. ChatGPT 5.5 и Claude Opus 5 при верно подобранных запросах признавались в искусственном происхождении, а Gemini 3.1 Pro упорно отрицала это.

В Anthropic отметили, что в основной части эксперимента использовалась версия Claude 2025 года, а в актуальных сборках безопасность проработана заметно лучше.

Эксперты считают, что массового перехода мошенников на ИИ пока не будет: труд операторов колл-центров дешевле. Часто таких людей удерживают силой и угрозами, что делает схему выгоднее автоматизации.

При этом нейросети уже применяются на отдельных этапах: генерация фото и видео для обмана, а также улучшение текстов, если переписка ведётся на незнакомом мошеннику языке.

источник

Загрузка страницы