Что такое дипфейк: как работает и как распознать

13 мин чтения

Что такое дипфейк, спрашивают обычно после новости про очередной поддельный звонок. Слово знакомое, ощущение тревожное, а понимания никакого.

При этом дело дошло до вполне обычных людей. По опросу Банка России нейросети внедрило у себя каждое седьмое предприятие, и ещё каждое пятое к этому готовится. Генеративные модели переехали в обычные рабочие чаты, поэтому и подделанный голос коллеги перестал быть сюжетом из кино.

Разберём, что такое дипфейк простыми словами: как подделка устроена, почему привычные советы по распознаванию перестали работать, где проходит граница законного и что делать, если подделали именно вас.

Дипфейк что это: определение без страшилок

Дипфейк - это поддельное фото, видео или запись голоса, которые нейросеть сделала похожими на конкретного человека.

Слово собрали из двух английских: deep learning, то есть глубокое обучение, и fake, подделка. Отсюда и суть: подделку собирает обученная модель, тогда как обычный монтаж делают руками.

Видов у дипфейка три, и путать их между собой не надо.

  • Подмена лица. На чужое видео натягивается лицо другого человека. Тело и обстановка вокруг остаются исходными.
  • Поддельный голос. Модель слушает несколько минут записи речи и потом говорит этим голосом любой текст. Для звонка-обмана хватает и этого, видео не нужно вовсе.
  • Полностью сгенерированное видео. Тут нет ни исходной съёмки, ни реального человека в кадре: модель придумывает всё от начала до конца.

Первые два вида опаснее третьего, потому что опираются на настоящего человека и потому что дешевле в производстве.

Как работает дипфейк

Дипфейк ИИ создаёт без всякой особой технологии: никакого отдельного «движка для подделок» не существует. Всю работу делает обычная генеративная нейросеть, та же по устройству, что рисует картинки по описанию или пишет тексты.

Вся её работа держится на примерах. Ей дают тысячи кадров с одним лицом под разными углами и при разном свете, а модель выводит из них правило: как это лицо выглядит при повороте головы, при улыбке, в тени. Дальше она рисует его в новых кадрах, которых никогда не было.

С голосом происходит похожее. Модель разбирает запись речи на признаки: высоту, темп, характерные растяжки гласных, манеру обрывать фразу. Потом произносит этими признаками любой текст.

Почему подделка стала правдоподобной

Раньше моделям не хватало материала. Чтобы натянуть лицо на видео, нужны были часы съёмки с разных ракурсов, поэтому убедительные подделки получались только у публичных людей и только у тех, кто умел с этим возиться.

Сейчас порог упал по двум причинам. Модели научились достраивать недостающее и обходятся куда меньшим набором примеров. А сам набор примеров у большинства людей давно лежит в открытом доступе: селфи в соцсетях, видео с корпоратива, голосовые в мессенджере.

Из этого следует неприятный вывод. Материала на подделку хватает почти про каждого, кто хоть раз выкладывал своё фото.

Почему это перестало быть уделом студий

Генеративный ИИ разошёлся очень быстро, и цифры это подтверждают. Выгода, которую пользователи получают от таких сервисов сверх заплаченного, в США оценивается в 172 млрд долларов в год к началу 2026-го против 112 млрд годом раньше.

Волна подняла всё сразу. Те же модели, что помогают собрать презентацию и вытянуть старый снимок, умеют подставить чужое лицо. Инструмент один, и вся разница в том, чьё лицо в него загрузили и спросили ли разрешения.

Что ещё умеют такие модели?
Мини-уроки по AI показывают, как использовать их в обычной рабочей задаче.
Пройти мини-урок в promptyka

Где проходит граница: согласие, а не технология

Тут придётся остановиться подробнее, потому что этот момент почти нигде не проговаривают.

Оживить фотографию бабушки из семейного альбома и подставить лицо коллеги в чужое видео технически означает одно и то же действие. Модель одна, кнопка одна, качество результата одинаковое. На той же механике работает дубляж фильма чужим голосом, аватар ведущего в корпоративном ролике, замена фона на портрете и генерация иллюстрации по описанию.

Дипфейком поддельное видео делает не хитрая технология. Его делает таким отсутствие согласия у человека, чьё лицо или голос взяли.

Отсюда простое правило, по которому вы сами проверите любую свою затею с нейросетью. Спросите, знает ли о ней человек в кадре и согласен ли он. Со своей фотографией делайте что угодно. С фотографией родственника спросите родственника. С чужим лицом из интернета не делайте ничего.

Отдельно скажем про инструменты. В этой статье вы не найдёте ни одного названия сервиса или бота для подмены лица, и это осознанный выбор.

Причина простая. Когда мы собирали семантику темы, картина оказалась некрасивой. Запросов, которыми ищут интимные изображения конкретных людей без их согласия, примерно в полтора раза больше, чем всех познавательных вместе взятых. Заметную долю тут занимают телеграм-боты, которые делают такое с фотографиями девушек-блогеров, а среди свежих запросов встречаются имена подростков.

Инструкция «где сделать дипфейк» обслуживает эту аудиторию в первую очередь. Разделить читателей у такой инструкции не выйдет, поэтому мы её не пишем. Про легальные сценарии со своими снимками у нас есть отдельные разборы, и там названия сервисов на месте.

Как распознать дипфейк

Вопрос стоит прямо в поисковой выдаче, и отвечают на него все примерно одинаково. Проблема в том, что отвечают устаревшим.

Сразу честно: надёжного бытового способа отличить хорошую подделку от настоящей записи сейчас нет. Разглядывание кадра помогает всё хуже с каждым годом, зато другой подход даёт результат, и о нём ниже.

Признаки, которые больше не работают

Почти в каждой статье про дипфейки повторяется один набор советов, пришедший из середины прошлого десятилетия.

«Человек редко моргает».

Ранние модели действительно спотыкались на моргании, потому что учились на фотографиях, а на фотографиях люди в основном с открытыми глазами. Разработчики про это узнали и починили в первую очередь.

«Ищите артефакты по контуру лица».

Размытая граница у линии волос, дрожащий край подбородка, странная кожа у шеи. Современные модели видео держат согласованность между кадрами, и такой мусор из результата почти ушёл.

«Проверьте, совпадают ли губы со звуком».

По рассинхрону вы опознаете разве что дешёвую поделку, потому что аккуратно сделанная подделка его не даст.

Добавьте сюда обычное сжатие. Видео, прошедшее через мессенджер, теряет детали само по себе, а обработка снимка нейросетью дополнительно заглаживает следы. То, что вы ищете глазами, к вам просто не доедет.

Автоматические детекторы дипфейков мы по той же причине не рекомендуем. Их точность заметно падает, как только на вход приходит результат новой модели, которой они не видели.

Что работает сейчас

Смещайте проверку с картинки на обстоятельства. Изображение подделку почти не выдаёт. Гораздо больше о ней говорит то, как эту запись вам доставили.

  • Проверьте канал. Вам позвонил руководитель с незнакомого номера и просит срочно перевести деньги. Положите трубку и перезвоните сами на тот номер, который у вас записан. Это одно действие закрывает почти все сценарии голосовых подделок.
  • Обратите внимание на срочность. Обман почти всегда торопит. «Прямо сейчас», «только никому не говори», «потом объясню» - это признак куда более надёжный, чем любые артефакты в кадре.
  • Спросите то, чего нет в интернете. У модели есть про человека ровно то, что попало к ней в обучение. Вопрос про позавчерашний разговор или про то, что вы ели на прошлом дне рождения, она не вытянет.
  • Заведите с близкими кодовое слово. Простая договорённость на случай странного звонка. Договорённость занимает пять минут и держится против подделки любого качества.
Попробуйте

Договоритесь сегодня же с родителями и с кем-то из коллег о контрольном вопросе, ответ на который нельзя найти в соцсетях. Это самая быстрая защита из всех перечисленных, и она не требует ни техники, ни знаний.

Содержание

Что говорит российский закон

Сразу оговорка: ниже общая картина, юридическую консультацию она не заменяет. Правовая практика по теме меняется быстро, так что по своей ситуации спросите юриста.

Отдельной статьи за создание дипфейка в Уголовном кодексе нет. Законопроекты об этом вносились в Думу не раз, и обсуждение продолжается, но пока подделка сама по себе отдельным составом не считается.

Зато действует другой принцип, и он важнее. Дипфейк служит способом совершить преступление, поэтому отвечают за то, что с его помощью сделали. Если голосом руководителя выманили у бухгалтера деньги, дело квалифицируют как мошенничество. Если поддельным видео распространили заведомо ложные порочащие сведения, речь пойдёт о клевете. Если потребовали денег под угрозой публикации, добавится вымогательство, а сама подделка отдельной строкой не пойдёт.

Логика тут та же, что с поддельными документами. Если человек украл по поддельному паспорту, кража остаётся кражей, а подделка входит в неё как способ, отдельной оценки не требует. Юристы, разбиравшие внесённые законопроекты, ровно на эту аналогию и ссылаются.

Гражданская сторона для обычного человека даже практичнее. В Гражданском кодексе есть статья 152.1 об охране изображения гражданина: обнародовать и использовать чужое изображение можно только с согласия этого человека. Исключения там узкие, вроде съёмки в публичном месте или государственного интереса.

Это значит, что для защиты своего лица вам не нужно ждать уголовного дела. Гражданский иск вы подаёте отдельно, и требовать по нему можно удаления материала и компенсации.

Что делать, если дипфейк сделали с вами

Порядок действий примерно такой, хотя в каждой ситуации детали свои.

1

Зафиксируйте доказательства. Сохраните ссылки, скриншоты с видимой датой и временем, сам файл. Материал удалят раньше, чем вы дойдёте до юриста, и без фиксации доказывать будет нечего.

2

Напишите жалобу площадке. У соцсетей и видеохостингов есть форма для сообщений о поддельном контенте и о нарушении права на изображение. По такой жалобе материал снимают быстрее всего.

3

Обратитесь в полицию, если есть состав. Повод для заявления даёт требование денег, обман или распространение порочащих сведений. Приложите то, что зафиксировали на первом шаге.

4

Предупредите тех, кого могут обмануть. Если вашим голосом звонят вашим же коллегам или родным, короткое сообщение в общий чат работает быстрее любого разбирательства.

Попробуйте

Поищите своё имя в поиске по картинкам и посмотрите, сколько ваших фотографий лежит в открытом доступе. Заодно проверьте настройки приватности там, где выкладываете снимки. Это не защитит полностью, но уменьшит материал, из которого делают подделку.

Частые вопросы

По самому видео получается всё хуже: современные модели держат и моргание, и согласованность кадров. Надёжнее проверять обстоятельства: кто прислал, по какому каналу, торопят ли вас с ответом. При звонке перезвоните сами на известный вам номер.

Коротко

Дипфейк это подделка лица или голоса, которую собрала нейросеть. Технология там ровно та же, что рисует картинки и оживляет старые снимки. Разводит эти случаи по разные стороны один вопрос: спросили ли согласия у человека, чьё лицо взяли.

Распознавать подделку глазами получается всё хуже. Переносите проверку с картинки на канал: перезвоните сами, спросите то, чего нет в сети, договоритесь с близкими о кодовом слове.

Закон отдельной статьи за дипфейк не даёт, зато отвечают за то, что с его помощью сделали, а своё изображение вы защищаете гражданским иском, не дожидаясь уголовного дела.

И последнее. Понимание, как эти модели устроены изнутри, защищает лучше любого списка признаков: разобравшись однажды, вы перестанете и пугаться лишнего, и верить лишнему. Начать проще всего с общей картины того, как нейросети работают.

Попробуйте миниуроки по AI бесплатно

Открыть доступ