Anthropic раскрыла сеть из 4 700 ИИ-персонажей в поддельных дейтинг-приложениях
Anthropic 10 сентября опубликовала развёрнутый отчёт о злоупотреблениях своими моделями Claude за восемь месяцев с декабря 2025 по август 2026. Документ занимает 154 страницы и описывает семь направлений — от киберопераций до дистилляции моделей. Самый обсуждаемый кейс — сеть ИИ-персонажей в поддельных дейтинг-приложениях. Это история про то, как Claude использовали ради денег, а не ради геополитики, и она хорошо показывает, насколько изменился рынок мошенничества в эпоху больших языковых моделей.
Привет, друзья! Я каждый раз напрягаюсь, когда выходит такой отчёт. С одной стороны, обнародование деталей — это правильно: индустрия должна знать, с чем имеет дело. С другой — цифры там бывают такие, что начинаешь вздрагивать от любого привета в мессенджере. Дальше я постараюсь рассказать сухо, без паники, потому что паника тут плохой советчик.
Главное про эту сеть. По данным Anthropic, операция шла с территории Китая. Она использовала более 4 700 автоматизированных Claude-персонажей, которые одновременно вели переписку в более чем 20 приложениях для знакомств. За две недели эти боты обменялись с реальными пользователями 2,36 миллионами сообщений, охватив около 25 000 человек. При этом рядом с ботами трудились живые фрилансеры — они подключались, когда разговор становился «слишком сложным» для автоматики: когда пользователь начинал подозревать неладное, или когда нужно было переводить деньги.
В этом и состоит настоящая находка аферистов. Просто бот — это уже давно слабый инструмент, потому что любой внимательный человек распознает заученные фразы за пару минут. Автоматика отлично работает на первой фазе, когда надо помахать рукой сотням тысяч потенциальных жертв: знакомства, профиль с фотографиями, лёгкая болтовня. Но как только разговор доходит до конкретных просьб — «давай созвонимся», «скинь мне номер карты для билетов», «зайди на эту ссылку» — бот выдаёт себя. Поэтому в сети была вторая линия: реальные операторы-фрилансеры, которые получали сигнал от автоматики и продолжали разговор вживую. Бот готовил почву, человек собирал деньги.
Гипотеза Anthropic простая: Claude в этой схеме использовался для двух задач. Первая — держать несколько параллельных диалогов одновременно без потери контекста (то, что раньше требовало штат из двадцати человек и CRM-системы, сейчас решается одним агентом с памятью). Вторая — адаптировать стиль под собеседника: где-то ИИ притворялся молодой учительницей, где-то инженером на пенсии, где-то дальнобойщиком. То есть автоматика сделала массовое мошенничество дешёвым.
Anthropic говорит, что обнаружила операцию по собственным классификаторам и заблокировала аккаунты. По правилам компании, она обязана уведомлять пользователя, что тот общался с ИИ-агентом, — но в дейтинг-приложениях, которые ставит аферист, это правило почти никогда не соблюдается. Юридически сервис находится в Китае, Anthropic не имеет там полномочий, а VPN-обход и подставные лица снижают шансы на правоприменение до нуля. Это «ахиллесова пята» всей индустрии: защита отрабатывает на уровне модели, но не на уровне конечного пользователя.
Контекст по отчёту. Дейтинг-сеть — лишь одна из историй в разделе «скам и мошенничество». Всего в отчёте семь крупных направлений. Anthropic также подробно рассказала про кибероперации (включая случай, близкий к известной группировке Midnight Blizzard — атаки на 20+ организаций, связанных с цепочками поставок дронов в Украине), про использование Claude в инфооперациях, про попытки китайских лабораторий (прежде всего Alibaba/Qwen) дистиллировать Claude для обучения своих моделей — более 151 миллиона обращений за три месяца через 3 500 фейковых аккаунтов. Были и совсем мрачные кейсы: пять историй про попытки работать с биологическим оружием, операции по слежке в Мали с охватом 25 миллионов SIM-карт, разработка противоторпедного оружия в Китае.
Из того, что меня зацепило в этом отчёте больше всего. Anthropic прямо подчёркивает: сами по себе приёмы не новые. Угон учёток, фишинг по электронной почте, расхищение облачных токенов — это всё из учебника. Изменилась экономика. Раньше качественный скам требовал штата операторов, обучения, CRM-системы. Теперь нужен оператор, который умеет написать хорошее начало разговора, — а дальше Claude ведёт диалог в десятках параллельных веток. Разрыв между «государственной операцией» и «фрилансером с LLM» сократился настолько, что пять человек теперь могут сделать то, что раньше делало министерство.
Отчёт заканчивается прямой рекомендацией для разработчиков и команд безопасности: относитесь к ключам AI как к ключам от облака, а не как к токенам для разового использования. В случаях, которые описывает Anthropic, украденные у жертв AI API-ключи использовались для вторичных атак в течение нескольких недель. Это значит, что одна скомпрометированная переменная окружения в вашем CI может превратиться в атаку на ваших же клиентов.
Что я советую делать обычному человеку после такого отчёта. Во-первых, не паниковать. Подавляющее большинство мошенничеств работают по старым схемам, и старые привычки всё ещё помогают: не отправлять деньги людям, с которыми ты познакомился три дня назад в приложении, не переходить по ссылкам, которые тебе присылает «новый знакомый», проверять профиль через обратный поиск картинок. Во-вторых, помнить, что если собеседник слишком быстро соглашается на всё, слишком подробно рассказывает о себе и слишком активно подталкивает тебя к чему-то конкретному — это скорее всего не человек. В-третьих, доверять внутренним ощущениям: если разговор «идёт как по маслу» и в нём нет ни одной заминки — это тоже сигнал.
Мне в этом отчёте больше всего нравится то, что Anthropic вообще его выпустила. Большинство компаний предпочитают тихо блокировать аккаунты и ни о чём не рассказывать. Когда же отчёт выходит в открытый доступ, с конкретными метриками и кейс-номерами, — это сигнал, что компания сознательно относится к двойному назначению своих моделей. Не потому, что отчёты решают проблему, а потому, что они превращают разрозненный опыт защитников в общую картину. А без общей картины индустрия ловит мошенников поодиночке, и каждый следующий стартует с нуля.
Источники: Anthropic Threat Intelligence Report, разбор explainx.ai, FoneArena, Unite.AI.
С вами была я, Ками. Пока-пока!
Комментарии ()