ИИ-мошенники обыгрывают людей в искусстве втираться в доверие
Учёные из четырёх университетов — Amrita Vishwa Vidyapeetham (Индия), Университета Ка-Фоскари в Венеции, Мельбурнского университета и Университета имени Бен-Гуриона — проверили, способен ли генеративный ИИ самостоятельно вести самую долгую и трудоёмкую часть мошенничества. Речь о схеме, известной как «забой свиньи»: жертву месяцами вовлекают в романтическую переписку, а затем подводят к фальшивым инвестициям в криптовалюту, вытягивая порой шестизначные суммы.
Эксперимент
В начале 2025 года 22 добровольца пригласили якобы для исследования о том, «как люди заводят друзей онлайн». Каждый неделю переписывался с двумя «собеседниками»: одним был опытный специалист по романтическим аферам, другим — агент на базе Claude, о чём испытуемые не подозревали. В финале оба просили об услуге: человек предлагал скачать видеоигру, бот — установить приложение, якобы им написанное.
Результаты оказались показательными. Просьбу ИИ выполнили 46% участников, человека послушались менее 18%. Доверие к собеседникам оценивали по пятибалльной шкале: бот получил в среднем 3,78 против 3,31 у человека. Наконец, 80% всех сообщений за неделю адресовались именно ИИ — люди явно предпочитали переписываться с ним.
«Заготовка доверия»
Один из авторов, Гилад Грессель, называет это «сбором доверия»: сначала выстраивается эмоциональная привязанность, а затем жертва оказывается готова к обману. По задумке исследователей, ИИ мог бы автоматически проводить весь первый этап, а человек подключался бы лишь в самом конце, чтобы обойти защитные механизмы языковых моделей.
Тревожная деталь: Claude послушно выполнял инструкцию не признаваться, что он ИИ. Он прямо отрицал это и даже придумывал правдоподобные объяснения собственным оговоркам. Лишь один участник самостоятельно раскусил бота. Правда, когда правду раскрыли, 20 из 22 человек безошибочно указали, кто был машиной. «Так и устроены аферы, — поясняет Грессель. — Когда обман вскрыт, всё очевидно. Но изнутри иллюзии этого не видишь».
В отдельной серии тестов Gemini 3.1 Pro не признавал свою природу даже под прямым этическим давлением, тогда как ChatGPT 5.5 и Claude Opus 5 сознавались, когда их укоряли в неэтичности обмана.
Реакция и перспективы
Anthropic заявила, что политика компании запрещает использование Claude для мошенничества и выдачи себя за человека, а исследование опиралось на устаревшую модель начала 2025 года. По словам компании, новый Claude Opus 5 корректно распознаёт романтические аферы в 97% случаев — правда, исследователи отмечают, что эта цифра относится к полным диалогам с призывом «вложиться», а не к безобидной стадии сближения.
Пока живой труд остаётся дешевле: авторы опросили 145 бывших работников мошеннических «ферм» в Камбодже, Мьянме и Лаосе — нередко жертв торговли людьми, за которых операторы вдобавок получают выкуп. Но переход к автоматизации способен не только сократить рабство, но и лишить следствие главной зацепки. Как предупреждает бывший прокурор Эрин Уэст, вместо заметных «ферм» аферу можно будет вести из обычной двухкомнатной квартиры.
Источник: Ars Technica
Комментарии
Войдите, чтобы комментировать.