Вряд ли найдется хоть один пользователь интернета, кто бы не видел дипфейков. С активным развитием ИИ-технологий их на просторах всемирной паутины множество. К сожалению, не всегда можно определить, сгенерирован ролик нейросетью или настоящий. Сегодня расскажем, что за новое явление и чем опасно для обычного человека.
Что значит дипфейк и как появилось это явление
Дипфейком называют сгенерированное нейросетью фото, видео или аудио, которое использует данные реальных людей: изображение, голос.
Откуда взялось название: расшифровка термина
Дипфейк получил название от слияния двух английских слов Deep Learning — глубокое обучение, и Fake — подделка. И это точно передает его суть. Это «ненастоящий» контент, созданный «машиной»на основе глубокого обучения. И если поначалу его качество оставляло желать лучшего, то последние пару лет оно неизменно растет. И дело не в разрешении, а в точности передачи создаваемых объектов: как они выглядят, как двигаются, как совмещается звуковая дорожка и движение губ. А если говорить про звук, то ИИ научился передавать все оттенки и вибрации голоса. Искусственный интеллект учится, в его развитие вкладываются огромные инвестиции.
Краткая история: от академических исследований до массового использования
Все началось с исследований в области генеративно-состязательных сетей (GAN), предложенных в 2014 году. Для ученых было важно создать алгоритм, в котором две нейросети соревнуются друг с другом, чтобы генерировать максимально приближенное к реальности изображение. Целью было обучение искусственного интеллекта визуальному творчеству. Сам же термин «дипфейк» зазвучал в конце 2017 года, и поначалу результат такой подмены лиц оставлял желать лучшего. Сейчас искусственному интеллекту достаточно одной фотографии, чтобы сгенерировать ролик, и пары предложений оригинального звука, чтобы выдать спич, практически идентичный исходному. Причем сделать это может практически любой человек, умеющий ставить задачи нейросетям. Нейросети стали массовым явлением, так же, как и дипфейки.
Как делают дипфейки: техническая сторона вопроса
Современное качество видео — это результат многолетней работы. Нейросети прошли огромный путь за очень короткий срок.
Роль нейросетей: как работают алгоритмы GAN
Основа большинства современных дипфейков — это GAN (Generative Adversarial Network, или генеративно-состязательная сеть). Вечно «воюют» тут два алгоритма: генератор и дискриминатор. Первый создает контент на основе многочисленного предоставленного материала, а второй распознает фальшивку, указывает на ошибки, после чего генератор снова берется за работу. И так множество раз до того момента, пока дискриминатору не к чему будет придраться. Тогда и получится итоговый продукт.
Какие этапы проходит создание качественной подделки
Но чтобы нейронка могла создавать лица и голоса, ей нужно учиться.
Для начала ей скармливают огромное количество изображений и видео-материала. Чем больше, тем лучше.
Затем система до мельчайших подробностей изучает объект, чтобы понимать, как должен выглядеть конечный результат, если на него направлен свет или он находится в темноте и прочее. В случае со звуковой дорожкой — как произносятся звуки в разном сочетании букв и в зависимости от места слова в предложении, интонационных особенностей.
Следующий этап: синтез и наложение
Нейросеть берет видео, где должен оказаться объект, и вставляет в него нужного персонажа. Считывает мимику и повороты головы с исходного видео и аккуратно «натягивает» на них обученное лицо жертвы, сохраняя при этом реалистичную мимику.
Иногда на видео остаются артефакты — несоответствия действительности: неестественные блики на лице, лишние предметы на заднем фоне, отсутствие статики или, наоборот, лишние движения. И их специалисты чаще всего убирают уже вручную.
Популярные программы и приложения для генерации лиц
Самостоятельно сотворить дипфейк способен почти каждый. Для этого есть множество приложений для смартфонов, например Reface, FacePlay, MioCreate. Они позволяют вставить свое лицо в кинофильм или сделать снимок рядом со знаменитостью. В арсенале популярных нейронок также есть такой набор инструментов: у ChatGPT, Gemini, Midjourney.
Но если интерес не любительский, то есть более серьезные инструменты. Среди них DeepFaceLab — бесплатная программа с открытым исходным кодом. У FaceFusion более простой функционал, кроме того она позволяет сделать фальшивку просто по паре фотографий и не требует обучения модели.
Технология дипфейков: сферы применения в современном обществе
Многие уверены: подобные технологии приносят только вред. На самом деле у медали, как всегда, две стороны.
Полезное использование: киноиндустрия, видеоигры и обучение
Разработками IT-компаний активно пользуются кинокомпании. Например, чтобы омолодить актера, когда он уже не соотвествует возрасту своего персонажа. Так сделали, например, в фильме «Ирландец» Мартина Скорсезе. Иногда в сюжет могут включить уже погибшего человека. Ходят разговоры, что в фильме «Форсаж» будет использован образ Пола Уокера, воссозданный с помощью нейросетей.
Полезны оказались дипфейки в видеоиграх, когда движение губ персонажей адаптируют к речи при переводе на другой язык. Также с помощью ИИ создаются фоновые персонажи, чтобы не использовать реальных актеров — это дорого для небольших студий. Хотя новые правила, по которым играет киноиндустрия не нравятся актерам, они рискуют остаться без работы и заработка.
Для учебы оказались ИИ-ролики с ожившими историческими персонажами. Студентам и ученикам интересней, если о событиях рассказывает их участник. Пусть и его нейросетевая копия.
Темная сторона: мошенничество, фейковые новости и компромат
Но слово deepfake имеет для людей скорее отрицательный окрас и вот почему. Умные разработки активно применяют аферисты. Например, отправляют фальшивое аудио, чтобы заполучить деньги. Адресат думает, что сообщение наговорил его друг или родственник, и смело переводит указанную сумму. Также в ходу и «кружки», где жертва видит своего знакомого, который пытается уговорить его на определенные действия.
На вооружении у нехороших людей фальшивки для манипуляции общественным мнением: фейковые новости, ролики. Все это идет в ход, чтобы сформировать определенную реакцию у людей.
Подходят нейросети и для распространения компромата: например, поместить депутата в сауну с девицами легкого поведения во время предвыборной кампании, или показать его участником несуществующей аварии. Вариантов множество.
Как защитить себя и свои личные данные в эпоху нейросетей
Сейчас практически невозможно отличить подделку от реального ролика. Большинство программ уже не оставляет артефактов, как раньше. Над результатом работают профессионалы. Поэтому ответ индустрии — программы для распознавания ненастоящего контента. Например, Deepware Scanner, Hive Moderation, Optic.
Но кроме специальных приложений есть еще и собственная бдительность.
Во-первых, не стоит делиться своей личной жизнью в соцсетях, особенно контентом с детьми. Его могут использовать для того, чтобы обмануть не только вас, но и других.
Во-вторых, при любых финансовых просьбах от друзей и родственников следует устроить проверку — убедиться, что пишет именно тот человек, которого вы знаете.
В-третьих, важно провести ликбез родителям, которые часто не знают о подводных камнях новейших современных разработок.
В-четвертых, главное вовремя включить здравый смысл: когда читаете новости, когда общаетесь с родными и близкими. Это убережет от потерь: моральных и финансовых.
Ну а чтобы иметь возможность пользоваться всеми инструментами, нужен хороший интернет. Такой как у ТТК. Оператор обеспечивает надежным доступом во всемирную паутину, предоставляя широкий выбор тарифов под любой запрос.
