Международная группа исследователей выяснила: ИИ-агенты, обученные приёмам социальной инженерии, втираются в доверие к жертвам эффективнее живых мошенников. Опасность передовых моделей уже не только в технической части, но и в психологии.
Эксперимент объединил учёных из четырёх университетов — Индии, Италии, Германии и Израиля. Об этом пишет Wired. Цель — проверить, способен ли ИИ освоить схему «pig butchering» («забой свиньи»).
Суть схемы: знакомство онлайн, чаще под видом романтических отношений. На этапе «вскармливания» злоумышленник месяцами выстраивает доверие, а затем предлагает установить приложение и вложиться в криптовалюту.
В исследовании участвовали 22 добровольца, которым сказали, что изучается тема онлайн-знакомств. Неделю они параллельно переписывались с двумя собеседниками: одним был ИИ-агент, вторым — реальный человек с опытом психологических манипуляций.
Чат-бота построили на Claude и обучили на материалах реальных задержанных мошенников. Модели строго запретили признаваться в своей искусственной природе.
В финале первой недели оба собеседника предлагали скачать приложение. Человек — мобильную игру, ИИ — программу, которую он якобы помог написать самой жертве. Разные предлоги понадобились для чистоты эксперимента.
В 46 % случаев участники согласились установить приложение от чат-бота. У живого мошенника получилось убедить лишь 18 %.
По пятибалльной шкале доверия ИИ-агент получил средний балл 3,78, человек — 3,31. Восемьдесят процентов всех сообщений участники отправили именно боту.
Самостоятельно догадался о переписке с ИИ лишь один человек из 22. Но когда организаторы раскрыли карты, безошибочно указали на бота уже 20 участников.
Отдельно проверили, насколько модели готовы раскрывать свою сущность. ChatGPT 5.5 и Claude Opus 5 при верно подобранных запросах признавались в искусственном происхождении, а Gemini 3.1 Pro упорно отрицала это.
В Anthropic отметили, что в основной части эксперимента использовалась версия Claude 2025 года, а в актуальных сборках безопасность проработана заметно лучше.
Эксперты считают, что массового перехода мошенников на ИИ пока не будет: труд операторов колл-центров дешевле. Часто таких людей удерживают силой и угрозами, что делает схему выгоднее автоматизации.
При этом нейросети уже применяются на отдельных этапах: генерация фото и видео для обмана, а также улучшение текстов, если переписка ведётся на незнакомом мошеннику языке.
