Что такое deepfake на самом деле
deepfake — это медиафайл — аудио, изображение или видео — синтезированный ИИ так, что реальный человек кажется говорящим или делающим то, чего он никогда не делал. Технология не нова, но недавно изменились две вещи: она стала дешёвой и достаточно качественной, чтобы случайный зритель не мог отличить подделку. На выборах такое сочетание превращает собственные голос и лицо человека в нечто, что может быть заимствовано противником.
Распространённый образ угрозы — безупречное поддельное видео с кандидатом. Однако на практике до сих пор реальность скромнее и изобретательнее: наиболее эффективные политические deepfakes были аудио, а не видео — потому что аудио дешевле в создании, не содержит визуальных признаков, выдающих поддельное видео, и незаметно распространяется через голосовые сообщения в приложениях для приватного обмена сообщениями.
Случай Slovakia: подделка в тишине
Показательный пример — парламентские выборы в Slovakia 30 сентября 2023 года. Примерно за 48 часов до открытия участков в социальных сетях распространился аудиоклип, якобы фиксирующий разговор Michal Šimečka, лидера либеральной партии Progressive Slovakia, и журналиста газеты Denník N о том, как сфальсифицировать голосование путём покупки бюллетеней у ромского меньшинства. Разговор не происходил; аудио было подделкой.
Опасность заключалась не в качестве подделки, а в тайминге. Она появилась в пределах 48-часового предвыборного моратория Slovakia — установленного законом периода тишины, когда СМИ и политики ограничены в ведении агитации, — поэтому именно те, кто лучше всего мог бы её опровергнуть, были ограничены в возможности громко ответить, пока она распространялась. Progressive Slovakia в итоге проиграла выборы с небольшим отрывом.
Здесь важен стандарт «0 bullshit». Возникает соблазн назвать это «deepfake, который решил исход выборов». Однако тщательный академический анализ словацкого случая показал, что противоположная степень уверенности не обоснована: фактическое влияние подделки на результат невозможно выделить из всего остального, что меняло голоса. Честный вывод касается метода — подделки, усиленной таймингом, — а не доказанного изменения исхода.
Две угрозы: подделка и дивиденд лжеца
Deepfakes угрожают выборам двумя различными способами, и второй легко упустить.
- Сфабрикованный фрагмент. Синтетическое аудио или видео, опубликованное для дискредитации кандидата или инсценировки скандала — желательно слишком поздно для опровержения, как в Slovakia.
- дивиденд лжеца. Более тонкий вред. Как только всем становится известно, что убедительные подделки существуют, политик, пойманный на реальной записи, может просто заявить, что это deepfake. Само существование технологии даёт лжецам готовый путь к отступлению — и потому deepfakes подрывают доверие даже тогда, когда никакая подделка фактически не используется.
Второй риск, вероятно, представляет собой большую долгосрочную угрозу. Одну подделку можно опровергнуть; общий распад принципа «увидеть — значит поверить» — нельзя, и он наносит ущерб как честным, так и нечестным.
Почему аудио — передний край
Стоит конкретно объяснить, почему лидирует аудио:
- Стоимость. Для пригодного клона голоса нужны лишь несколько минут реальной речи цели — а для любого публичного лица этого в избытке.
- Отсутствие визуальных признаков. Поддельное видео всё ещё выдаёт себя по рукам, зубам, морганию и освещению. У аудио нет сопоставимых явных признаков для случайного слушателя.
- Низкое качество скрывает дефекты. Намеренно записанный с качеством телефонного звонка фрагмент заставляет любые артефакты звучать как плохая связь, а не как подделка.
- Скрытое распространение. Голосовые сообщения перемещаются по закрытым каналам — WhatsApp, Telegram, Signal — где их не видят ни фактчекеры, ни платформы, чтобы вмешаться.
Что на самом деле защищает выборы
Инструменты обнаружения помогают, но всегда отстают от подделок, поэтому устойчивые меры защиты носят процедурный и человеческий характер:
- Prebunking. Предупреждение аудитории заранее о том, что подделки в последний момент вероятны, чтобы поздний фрагмент встречали с подозрением, а не с доверием.
- Происхождение важнее содержания. Оценка фрагмента по тому, откуда он взялся — кто опубликовал его первым, когда и с каким источником, — а не по тому, насколько убедительно он звучит.
- Устранение ловушки периода тишины. Случай Slovakia показал, как правила моратория могут защищать подделку; несколько юрисдикций теперь пересматривают, как допускается опровержение в период тишины.
- Быстрое, заслуживающее доверия опровержение. Надёжное и оперативное отрицание со стороны лица, чью личность имитировали, и независимых изданий, готовых действовать в момент появления подделки.
Ничто из этого не требует распознавать подделку на глаз — и это кстати, потому что с каждым годом это становится всё труднее. Практические навыки самостоятельной проверки подозрительного фрагмента относятся к треку Verify, но подход начинается здесь: когда незадолго до голосования появляется шокирующая запись, первый вопрос не «это настоящее?», а «откуда это взялось и почему именно сейчас?»