Один и тот же приём — два противоположных финала
В начале 2024 года сотрудник гонконгского офиса британской инженерной компании Arup (той самой, что участвовала в проектировании Сиднейского оперного театра) получил приглашение на видеозвонок с финансовым директором компании и несколькими знакомыми коллегами. Все на экране выглядели и говорили точно как настоящие сотрудники — потому что мошенники воссоздали их внешность и голоса по видео и аудио из открытых источников, включая, предположительно, записи предыдущих внутренних совещаний компании и публичные выступления. Сотрудник выполнил 15 переводов на общую сумму 25,6 млн долларов на пять разных счетов в гонконгских банках, прежде чем обман раскрылся — почти неделю спустя, когда кто-то из настоящих сотрудников случайно упомянул сделку, о которой не имел ни малейшего представления.
Полгода спустя похожая схема нацелилась на Ferrari: топ-менеджеру компании начали приходить сообщения в WhatsApp, якобы от генерального директора Бенедетто Виньи, с незнакомого номера — сопровождаемые фотографией профиля с логотипом Ferrari и срочной просьбой согласовать конфиденциальную сделку по поглощению, о которой уже якобы уведомили итальянского регулятора и биржу. Голос в последовавшем звонке звучал убедительно, вплоть до южноитальянского акцента реального Виньи. Но менеджер засомневался, заметив небольшие неровности в интонации, — и задал звонившему личный вопрос о книге, которую настоящий Винья недавно ему порекомендовал. Собеседник не смог ответить, и звонок оборвался. Атаку предотвратили, а Ferrari начала внутреннее расследование инцидента.
Это не единичные случаи
Ещё до атаки на Ferrari похожая попытка была зафиксирована в отношении Марка Рида, генерального директора крупного рекламного холдинга WPP: мошенники использовали записанный из публичных источников голос и изображение руководителя, чтобы попытаться убедить сотрудников компании перевести деньги и раскрыть конфиденциальную информацию под предлогом нового делового предприятия, якобы требующего срочного начального финансирования. Как и в случае с Ferrari, попытку раскрыли благодаря бдительности сотрудников, заметивших несоответствия в поведении и содержании запроса, а не благодаря какому-либо техническому средству обнаружения подделки.
Схожесть этих историй — не совпадение, а отражение более широкой тенденции: по мере того как инструменты синтеза голоса и видео становятся доступнее и качественнее, схема «мошенничество от имени руководителя» переходит из формата поддельных электронных писем в формат поддельных видеозвонков и голосовых сообщений — то есть в те каналы связи, которым сотрудники традиционно доверяли больше всего именно потому, что голос и лицо казались более надёжным доказательством личности, чем текст письма, который несложно было заподозрить в подделке при внимательном чтении.
Как устроена механика подобных атак
В обоих случаях мошенники использовали не какую-то экзотическую уязвимость в банковских системах, а комбинацию двух давно известных элементов социальной инженерии, усиленных новой технологией. Первый элемент — классическая схема «мошенничество от имени руководителя» (CEO fraud), где сотрудника убеждают выполнить срочный денежный перевод от имени начальства, минуя обычные процедуры согласования, — эта схема существовала задолго до появления технологий синтеза голоса и видео и десятилетиями работала через обычные поддельные электронные письма. Второй, принципиально новый элемент — синтетический голос и видео, сгенерированные на основе общедоступных записей реального человека, которые делают убедительной саму личность звонящего, а не только текст сообщения, снимая тот уровень недоверия, который обычно вызывает письмо с незнакомого адреса.
Ключевая деталь механики — искусственно создаваемое давление срочности и конфиденциальности: в обоих случаях мошенники настаивали на немедленных действиях и просили не обсуждать ситуацию с другими сотрудниками, ссылаясь на конфиденциальность сделки. Это старый приём социальной инженерии, применявшийся ещё в дотехнологическую эпоху мошенничества, — чем меньше времени у жертвы на проверку и чем меньше людей вовлечено в процесс, тем ниже шанс, что кто-то заметит несостыковку. В случае Ferrari мошенники дополнительно сослались на то, что регулятор и биржа уже уведомлены о сделке, — деталь, призванная создать ощущение необратимости процесса и снизить желание перепроверять запрос через другие источники.
Почему один случай сработал, а другой нет
Разница между двумя исходами — не в качестве самой технологии подделки, а в наличии независимого канала проверки личности собеседника. В Гонконге сотрудник видел «знакомые лица» сразу нескольких коллег одновременно на групповом видеозвонке, что психологически резко снижало уровень подозрительности, — сложно усомниться в подлинности звонка, если на нём одновременно несколько узнаваемых людей, тем более если организационная культура компании не предполагала отдельной проверки подлинности видеозвонков как стандартной процедуры. В случае Ferrari менеджер применил простой, но эффективный метод: задал вопрос, ответ на который знает только реальный человек, а не что-либо, извлекаемое из публичных данных для обучения модели голоса или видео, — и именно этот способ проверки, а не техническая экспертиза в области ИИ, раскрыл подделку.
Что это меняет для финансовых организаций
Оба случая показывают одну и ту же практическую рекомендацию: любой запрос на срочный денежный перевод, особенно поступивший по видео или голосовой связи и сопровождаемый требованием конфиденциальности, стоит проверять через независимый, заранее согласованный канал связи — например, обратный звонок на заведомо известный номер, а не тот, с которого поступил запрос, или заранее оговорённое кодовое слово, известное только реальным сотрудникам. Технология создания правдоподобных голосов и видео развивается быстрее, чем способность человека визуально или на слух отличить подделку, — а значит, единственная надёжная защита лежит не в попытке распознать подделку «на глаз», а в организационных процедурах проверки, которые не полагаются на визуальное или голосовое узнавание вообще.
Показательно, что именно этот принцип и сработал в случае с Ferrari: менеджер не пытался технически проанализировать голос на предмет искусственного происхождения — он полагался на простую проверку знания, которым мог обладать только реальный собеседник, знакомый с ним лично на протяжении долгого времени. Это гораздо более устойчивый метод защиты, чем попытка натренировать сотрудников распознавать артефакты синтетической речи или видео, потому что качество подделок продолжает расти, а актуальность конкретных технических признаков подделки устаревает почти так же быстро, как и сами инструменты их создания.
Регуляторы и страховые компании уже начали реагировать на эту тенденцию: часть страховщиков, работающих с корпоративными клиентами, пересматривает условия полисов киберстрахования, добавляя отдельные оговорки про мошенничество с использованием синтетических медиа, а часть банков усиливает процедуры дополнительного подтверждения для крупных международных переводов, инициированных после видео- или голосового звонка, а не только письменного запроса.
Что из этого следует
История Arup и Ferrari — не про исключительную технологическую беспомощность одной компании и исключительную бдительность другой, а про то, что при равном качестве технологии подделки решающим фактором остаётся человеческий протокол проверки, а не способность заметить артефакты синтезированного видео или голоса. Компания, которая полагается на «узнавание» коллеги по голосу или лицу как достаточное доказательство подлинности, сегодня доверяет ровно тому каналу проверки, который технология подделки научилась имитировать лучше всего. Разница между 25,6 млн долларов убытка и предотвращённой атакой в этих двух историях свелась не к бюджету на кибербезопасность и не к квалификации ИТ-отдела, а к одному простому вопросу, заданному в нужный момент вместо того, чтобы довериться знакомому лицу на экране.
Миллион на рынке форекс 
