Борьба с киберугрозами: как ваш перевод проходит проверку за доли секунды
Постоянное обучение, тысячи параметров и ансамбль машинных моделей — рассказываем об устройстве банковских антифрод-систем.
Когда вы оплачиваете покупку картой или переводите деньги, в другой плоскости цифрового мира происходит настоящая битва. Ваш платеж — лишь одна из миллионов транзакций, которые ежесекундно обрабатываются банками. Этот процесс остается невидимым для пользователя, но от его качества зависит и финансовая безопасность клиента, и экономическая эффективность банка. Современные антифрод-решения — сложнейший ансамбль алгоритмов машинного обучения, работающих в режиме реального времени.
От жестких правил к интеллектуальному анализу
Исторически защита от мошеннических транзакций строилась на системе фиксированных правил и лимитов. Превысил сумму — блокировка. Перевод в другую страну — дополнительная проверка. Устройство в черном списке — отказ. Такой подход работал, но был похож скорее на грубые мазки: он позволял оценить лишь отдельные признаки подозрительного поведения, не складывая их в целостный портрет клиента.
А их важно анализировать и принимать во внимание: предположим, клиент Х переводит другому пользователю крупную сумму, превышающую некий заданный лимит — и система блокирует перевод. Впоследствии выясняется, что транзакция вполне легитимна, например, она предназначена любимой дочери. А потом оказывается, что такой перевод клиент Х делает регулярно, на день рождения. И если в первый раз клиент еще мог выяснить ситуацию и, выражаясь фигурально, «понять и простить», то в случае повторной блокировки клиент Х, скорее всего, просто станет клиентом другого банка.
И именно здесь на помощь приходит искусственный интеллект. Его главное преимущество — способность анализировать не пять-десять факторов, а тысячи параметров одновременно. Вместо того чтобы сказать: «перевод больше ста тысяч рублей — это подозрительно», ИИ учитывает историю всех ваших трат за последние годы, устройство, с которого вы совершаете платеж, вашу географию, время и даже то, как быстро вы вводите данные. Это позволяет банку покрывать больший объем мошеннических транзакций, при этом минимизировать количество ложных срабатываний и не блокировать легитимные операции клиентов. В результате сохраняется их лояльность и репутация банка.
Архитектура антифрод-решения: этапы обработки транзакции
Решение по платежу проходит через несколько этапов. Каждый из них имеет свой вес и по-своему влияет на конечный результат.
Шаг первый: превращение данных в признаки. Поступающая транзакция преобразуется в набор числовых характеристик, которые могут быть использованы алгоритмами. Туда входят сумма операции, идентификатор устройства, географические координаты, временные метки, история транзакций клиента за различные периоды (день, неделя, месяц), частота операций, способ авторизации. Современные системы могут воспринимать несколько тысяч признаков на одну транзакцию, создавая многомерное пространство для последующего анализа.
Шаг второй: ансамблевое скорингование. Ансамбль объединяет несколько алгоритмов, каждый из которых решает специализированную задачу, имеющую собственный вес (скор) в итоговом вердикте.
Первый компонент — модели, обученные «с учителем». Это значит, что они тренируются на размеченной исторической выборке, где каждая переданная на анализ транзакция уже помечена как легитимная или мошенническая. Модели изучают эту выборку, а потом работают на новых данных «по аналогии». Такие модели эффективно распознают известные схемы, но они слабы в определении принципиально новых видов мошенничества, которых не было в обучающих данных.
Этот недостаток компенсируется благодаря моделям, обученным «без учителя». Такими, например, являются методы поиска аномалий. Эти алгоритмы обучаются исключительно на легитимных транзакциях и самостоятельно формируют представление о том, как выглядит нормальное поведение клиента. Когда на вход поступает операция, отличная от массива «нормальных» операций по какому-либо значимому признаку, модель фиксирует аномалию.
По тому же принципу работают автоэнкодеры. Когда количество признаков измеряется тысячами, некоторые математические операции перестают быть эффективными, а значимые связи теряются в «шуме». Автоэнкодер же определяет, какие из признаков можно сгруппировать и «сжать» до менее многомерного набора данных, а потом «распаковать» обратно с минимальными потерями на легитимных данных.
Самый простой пример того, как работает сжатие признаков — это когда мы вместо «ширины» и «длины» запоминаем параметр «площадь» и работаем дальше с ним. Разумеется, это упрощение: часть информации при таком сжатии теряется осознанно — именно на этом и построено выявление аномалий.
Применительно к автоэнкодерам в банковских системах на легитимных транзакциях ошибка «распаковки» минимальна, тогда как аномальная транзакция восстанавливается с существенной погрешностью, что служит сигналом для системы.
Каждая модель ансамбля выдает собственный скор — числовую оценку вероятности мошенничества в диапазоне от 0 до 1. Финальная оценка формируется на основе агрегации этих результатов с учетом весов, назначенных каждой модели в зависимости от её достоверности в различных сценариях.
Шаг третий: пороговое принятие решений. После того как все модели выдали свои оценки, система оценивает итоговый риск и действует в зависимости от его уровня.
- Низкий риск: транзакция автоматически пропускается без дополнительных проверок.
- Средний риск: инициируется запрос дополнительной аутентификации — SMS-код, push-уведомление или биометрическая проверка.
- Высокий риск: транзакция блокируется до выяснения обстоятельств.
Конечно, у каждого банка свои алгоритмы действий и настройки систем, но в общем виде логика соответствует той, что описана выше. В особых случаях — например, когда речь идет о крупных суммах или о клиентах премиального сегмента — решение также может быть отправлено на проверку специалисту-человеку.
Не только одна транзакция: анализ связей
Отдельный контур защиты работает не с одной операцией, а со связями между ними. Мошеннические схемы редко ограничиваются единичным переводом: деньги проходят через цепочки счетов-«дропов», а одни и те же устройства, телефоны и получатели всплывают у формально не связанных между собой клиентов.
Графовая аналитика представляет клиентов, счета и устройства как узлы сети, а переводы — как связи между ними. Это позволяет увидеть то, что незаметно на уровне отдельной транзакции: кольцевые переводы, веерное распределение средств, сообщества счетов, которые обналичивают деньги сообща. Сетевой взгляд помогает вскрывать организованные схемы и выявлять новые счета-«дропы» ещё до того, как через них пройдёт основной поток украденных средств.
Гонка со временем и устойчивость к нагрузкам
Финансовые системы обязаны обрабатывать миллионы транзакций ежедневно, при этом время принятия решения не должно превышать долей секунды. Выполнение таких требований к производительности обеспечивает архитектура систем.
Во-первых, здесь работает каскадный принцип. Сначала транзакция проходит через самые легкие и быстрые правила и модели. Если результат очевиден — транзакция явно чистая или явно мошенническая — решение принимается моментально. Те случаи, которые вызвали сомнения, отправляются на более глубокий анализ с использованием ресурсоемких моделей.
Во-вторых, широко используется предварительный расчет. Многие характеристики клиентов и устройств вычисляются в асинхронном режиме и сохраняются. Это позволяет существенно сократить объем вычислений, необходимых непосредственно в момент транзакции.
В-третьих, критически важные вычисления выполняются параллельно на распределенных вычислительных кластерах, благодаря чему систему можно быстро масштабировать, если вдруг срочно требуются дополнительные мощности.
Дрейф данных и адаптация к новым угрозам
Мошенники непрерывно разрабатывают новые схемы, и статистические свойства данных транзакций со временем меняются. В машинном обучении это явление известно как дрейф данных — модель, обученная на исторических массивах, постепенно теряет точность, поскольку реальные данные начинают отличаться от тех, на которых проводилось обучение.
Основное решение здесь — постоянное дообучение и донастройка моделей. В крупных банках цикл обновления может составлять от одного дня до нескольких недель в зависимости от объема поступающих данных и вычислительных ресурсов. В этом процессе особенно важна информация о том, была ли транзакция, пропущенная системой, впоследствии признана мошеннической. Такая операция добавляется в обучающую выборку, и модель корректирует свой анализ.
Границы применимости — где даже самый умный ИИ пасует
Важно понимать, что даже самые совершенные системы не обеспечивают стопроцентной защиты. Существуют объективные ограничения.
Компромисс между полнотой и точностью. В машинном обучении это противоречие формализуется как выбор между долей ложноположительных срабатываний и долей ложноотрицательных срабатываний. Важно понимать, что алгоритмы работают не с правильными и неправильными ответами, а с вероятностными оценками. То есть если мы хотим поймать сто процентов мошенников, мы неизбежно заблокируем и часть честных клиентов. И наоборот, если мы хотим, чтобы ни один добросовестный клиент не пострадал, мы пропустим часть мошеннических транзакций.
Оптимальный баланс определяется бизнес-стратегией банка: готов ли он мириться с дополнительными потерями от мошенничества ради комфорта клиентов, или предпочитает ужесточить контроль ценой некоторых ложных блокировок. Единого порога не существует.
Уязвимость перед социальной инженерией. Это наиболее серьезное ограничение с практической точки зрения. Когда мошенники вступают в прямой контакт с клиентом и убеждают его самостоятельно осуществить перевод на подконтрольный счет, транзакция технически выглядит абсолютно легитимной. Очень упрощенно говоря, если клиент перевел деньги с устройства, которым он обычно пользуется, в то время, когда он обычно активен, в диапазоне тех сумм, которые не выглядят аномально большими относительно его средств, то на уровне данных антифрод-системе практически не за что зацепиться.
В таких случаях защита сдвигается в другую плоскость. Банки внедряют механизмы охлаждения — временные задержки для крупных переводов, обязательные вопросы о цели операции при снятии наличных, системы информирования о типовых схемах обмана. Это та область, где техника бессильна, но где человек может и должен помочь другому человеку.
Будущее защиты в симбиозе
Современные антифрод-системы представляют собой сложные распределенные системы, объединяющие ансамбли моделей, механизмы каскадной обработки и системы регулярного переобучения. Их архитектура нацелена на решение двух взаимосвязанных задач: максимальное предупреждение мошеннических транзакций и минимизация ложных срабатываний, влияющих на удержание клиентов.
Искусственный интеллект позволил использовать тонкий многомерный анализ огромного объема данных. Однако там, где в дело вступает человеческий фактор — прежде всего в ситуациях социальной инженерии — на первый план выходят другие механизмы защиты и человеко-ориентированные процедуры, которые дополняют возможности алгоритмов.