3.3 Дипфейки и синтетический контент — Модуль 3
Модуль 3 · Тема 3.3
Слайд 1 из 15
Тема 3.3 · Модуль 3 · Критическое мышление в эпоху ИИ
Дипфейки
и синтетический
контент
Технологии ИИ-генерации создали новый класс информационных угроз. Изображение, голос, видео и текст теперь могут быть синтезированы с убедительностью, превосходящей человеческую экспертизу.
🖼
Синтетические изображения
Midjourney, DALL-E, Stable Diffusion — фотореалистичный контент за секунды
🎬
Видеодипфейки
Замена лица, клонирование голоса, синтез полного видео
🎙
Аудиодипфейки
Клонирование голоса, синтез речи — 3 секунды образца достаточно
📝
ИИ-текст
GPT-генерация — новости, аналитика, отзывы, научные статьи
⚠️
Ключевой вывод темы: визуальная проверка ненадёжна. Признаки синтетического контента меняются быстрее, чем методы обнаружения. Надёжная защита — контекстуальная верификация, а не попытка «увидеть» подделку.
Контекст
Масштаб
проблемы
Синтетический контент — не угроза будущего. Это уже происходит, и масштаб растёт экспоненциально.
📈 Рост
900%
рост числа дипфейков 2019–2024 (Sensity AI)
💸 Мошенничество
$25 млн
потери компании в Гонконге от CFO-дипфейка (2024)
🖼 Генерация
15 млрд
изображений создано Midjourney за первые 12 месяцев
🔊 Голос
3 сек
достаточно аудио для клонирования голоса (ElevenLabs)
Реальные случаи — нажмите для разбора
💰
Гонконг, 2024 — $25 млн через дипфейк-видеоконференцию
Сотрудник финансового отдела получил запрос на перевод от «CFO компании» через WhatsApp. Засомневавшись, согласился на видеозвонок. На звонке присутствовали «CFO» и несколько «коллег» — все оказались дипфейками в реальном времени. Сотрудник перевёл $25 миллионов.

Механизм: face-swap в реальном времени + клонированные голоса + заранее подготовленные «ответы» на типичные вопросы. Это не выдумка — подтверждено полицией Гонконга.
раскрыть
🗳
Выборы в Словакии, 2023 — аудиодипфейк за 48 часов до голосования
За 48 часов до парламентских выборов в соцсетях распространилась запись, на которой кандидат «обсуждает фальсификацию результатов с журналисткой». Факт-чекеры идентифицировали запись как дипфейк — но за двое суток она уже охватила значительную аудиторию.

Стратегия: время публикации выбрано специально — слишком мало для опровержения, достаточно для влияния.
раскрыть
🏢
Корпоративные мошенничества — «голос CEO» по телефону
В 2019–2024 годах зафиксировано множество случаев: сотрудники получают телефонный звонок от «руководителя» с просьбой срочно перевести средства или раскрыть данные. Голос — клонированный.

Защита: для финансовых операций — обязательный второй фактор верификации (например, ответное письмо на корпоративную почту или контрольное слово). Голоса недостаточно.
раскрыть
Классификация
Четыре типа
синтетического контента
Разные типы создаются разными технологиями — и требуют разных методов верификации. Нажмите на карточку.
📌
Важно: эти категории пересекаются. Наиболее опасные атаки используют мультимодальный синтетический контент — видео + голос + текстовый нарратив вокруг него. Каждый элемент может быть правдоподобным по отдельности, вместе они создают убедительную, но полностью синтетическую историю.
Механизм
Как создаются
дипфейки
Понимание технологии помогает понять, где искать признаки синтеза. Поверхностные знания — лучше, чем никаких.
Четыре ключевые технологии — нажмите для описания
GAN
Generative Adversarial Network — «соревнование» сетей
Две нейросети: генератор создаёт изображение → дискриминатор пытается определить, реальное оно или нет → генератор учится обманывать дискриминатор. Итог: генератор становится настолько хорош, что обманывает и людей.

GAN — основа большинства face-swap дипфейков 2017–2022. Характерный артефакт: иногда симметричные черты лица, «стеклянные» глаза.
раскрыть
Diff
Diffusion models — «шум → изображение»
Модель обучается «очищать» изображение от случайного шума. При генерации начинает с чистого шума и постепенно «проявляет» изображение согласно промпту. Midjourney, DALL-E 3, Stable Diffusion — всё это диффузионные модели.

Преимущество над GAN: значительно более высокое качество, меньше артефактов. Именно поэтому распознать диффузионные изображения сложнее, чем GAN-дипфейки 2019 года.
раскрыть
TTS
Voice cloning — клонирование голоса
Современные TTS (Text-to-Speech) системы умеют клонировать голос по 3–10 секундам образца. Система анализирует тембр, ритм, интонации — и воспроизводит их для произнесения любого текста.

ElevenLabs, VALL-E, Tortoise TTS — публично доступные инструменты. Именно это делает аудиодипфейки наиболее дешёвыми и массовыми в создании.
раскрыть
FFS
Face-swap в реальном времени — самая опасная технология
Swap лиц теперь работает в реальном времени — замена происходит в потоке видеозвонка, а не постфактум. Именно это использовалось в гонконгском случае.

Инструменты: DeepFaceLive, некоторые коммерческие сервисы. Требуется мощная видеокарта, но не экспертиза. Защита: нестандартные вопросы («Что мы обсуждали вчера после совещания?»), контрольные слова.
раскрыть
Визуальные маркеры · Изображения
Признаки
синтетических изображений
Ни один признак не является стопроцентным. Ищите совокупность — 3+ маркера одновременно делают синтетическое происхождение высоковероятным.
⚠️
Предостережение: признаки 2022 года уже неактуальны для моделей 2025-го. Технологии устраняют артефакты быстрее, чем мы учимся их распознавать. Визуальная проверка — необходимый, но недостаточный инструмент. Всегда дополняй контекстуальной верификацией.
🎯 Контрольный вопрос 1
Проверьте понимание
Вы видите вирусную фотографию: известный политик пожимает руку лидеру враждебного государства. На изображении нет явных артефактов — правильные руки, одинаковое освещение, естественные выражения лиц. Какой подход к верификации наиболее надёжен?
А
Доверять: отсутствие артефактов означает подлинность
Б
Загрузить в детектор дипфейков — он даст точный ответ
В
Обратный поиск по картинке + поиск новостей об этой встрече в Reuters/AP
Г
Сравнить тени и перспективу с архивными фото этих людей
Почему «отсутствие артефактов» — ненадёжный индикатор подлинности?
Ответ

Три причины:

1. Технологии улучшаются быстро: Midjourney v1 (2022) vs Midjourney v6 (2024) — принципиально разное качество. Список известных артефактов устаревает за месяцы.
2. Постобработка скрывает артефакты: сгенерированное изображение обрабатывается в Photoshop, сжимается при загрузке — артефакты исчезают.
3. Мы не видим то, чего не знаем: новые типы артефактов для новых моделей неизвестны рядовому пользователю. Только специализированные детекторы успевают за обновлениями.
Что такое обратный поиск по картинке и когда он не работает?
Ответ

Обратный поиск: Google Lens или TinEye находят другие контексты, в которых это изображение использовалось. Это показывает первую публикацию и все последующие — часто даже первоначальный правдивый контекст.

Когда не работает:
— Изображение свежее (не проиндексировано поисковиком)
— Изображение уникально создано (первая публикация — этот пост)
— Изображение было кадрировано или изменено — поисковик не находит оригинал

Решение для новых изображений: искать новости о событии, которое якобы изображено — а не само изображение.
Видеодипфейки
Признаки
видеодипфейков
Видео сложнее фальсифицировать идеально — проблем больше из-за временно́й непрерывности. Но технология стремительно развивается.
Визуальные маркеры в видео — нажмите для деталей
V1
Границы лица — «маска» поверх оригинала
При движении головы на краях лица иногда видна граница замены — небольшое размытие, «плавление», или несоответствие цвета кожи шеи и лица. Наиболее заметно при резких движениях или повороте.

Как проверить: замедли видео (0.25× скорость) и внимательно смотри на края лица при быстрых движениях.
раскрыть
V2
Мигание и движение глаз — неестественный паттерн
Ранние дипфейки (2018–2020) почти не моргали — ранние модели обучались на изображениях с открытыми глазами. Современные модели моргают, но всё ещё иногда неестественно: слишком редко, слишком синхронно, или аномальные движения зрачков.

Это один из наименее надёжных маркеров для 2024+ видео.
раскрыть
V3
Синхронизация губ — рассинхрон со звуком
Наиболее заметный маркер, особенно при быстром говорении: движение губ опережает или отстаёт от звука, или форма губ не соответствует произносимым звукам.

Особенно заметно для специфических звуков (P, B, M — губные согласные). Замедление видео и сравнение с аудио помогает.
раскрыть
V4
Освещение и тени — несоответствие
Свет на наложенном лице может не совпадать с освещением фона или шеи. Тени от носа и бровей могут падать не в ту сторону. При изменении освещения в сцене лицо-маска «не адаптируется» так же, как оригинальный фон.
раскрыть
V5
Артефакты при поворотах и экстремальных углах
При взгляде строго в камеру дипфейк часто выглядит убедительно. При повороте в три четверти или профиль — модели сложнее реалистично деформировать лицо. Проблемы с ушами (иногда исчезают), волосами по краям лица, очками.
раскрыть
Аудиодипфейки
Клонирование голоса:
самая скрытая угроза
Аудиодипфейки — наиболее дешёвые в создании и наиболее сложные для обнаружения «на слух». Требуют особого внимания.
"
В 2024 году мы проверили несколько образцов клонированного голоса на 50 участниках. Только 27% смогли отличить синтез от оригинала на уровне выше случайного угадывания. Человеческое ухо — ненадёжный детектор.
— Обобщённые данные исследований аудиоаутентичности, 2024
Что слушать — признаки синтетического голоса
🎙
Монотонность и аномальная интонация
Клонированный голос часто теряет естественную вариативность интонации в длинных фразах. Речь может звучать «механически» — особенно при паузах и смене темпа. Эмоциональная окрашенность (гнев, радость) хуже воспроизводится, чем нейтральная речь.
раскрыть
🎙
Аномалии в дыхании и паузах
Естественная речь содержит характерные паузы для вдоха, заполнители («э», «мм»), неидеальные переходы. Синтезированная речь часто либо лишена этих элементов (слишком чистая), либо содержит их в неестественных местах.
раскрыть
🎙
Несоответствие контексту говорящего
Голос может звучать правдоподобно, но речевые паттерны, лексика, характерные выражения конкретного человека — могут не совпадать. Если вы хорошо знаете говорящего — замечайте нетипичные для него обороты, непривычный темп речи.
раскрыть
Протокол защиты для корпоративных коммуникаций
Правило 1
Финансовые переводы — только по двум каналам. Звонок + письмо на корпоративную почту (не WhatsApp, не pers. email). Если подтверждение пришло только по одному каналу — стоп.
Правило 2
Контрольное слово или секретная фраза — для важных звонков. Заранее установленная с руководителем «кодовая фраза», которую нельзя угадать публично.
Правило 3
Перезвони самостоятельно — по официальному номеру из корпоративного справочника (не из того, с которого позвонили).
🎯 Контрольный вопрос 2
Проверьте понимание
Сотрудник получает голосовое сообщение от «директора по финансам» с просьбой срочно перевести 500 000 ₽ контрагенту — «цифры сходятся, голос знакомый, я его узнаю». Как поступить согласно принципам защиты от аудиодипфейков?
А
Перевести: голос узнаваем, значит запрос подлинный
Б
Прослушать несколько раз — если темп и паузы естественные, можно переводить
В
Игнорировать — финансовые запросы по голосовым недопустимы без исключений
Г
Перезвонить CFO по официальному номеру из справочника и запросить письменное подтверждение
Почему «срочность» запроса — важный красный флаг?
Ответ

Срочность — главный инструмент социальной инженерии.

Создание искусственного давления времени: «нужно прямо сейчас», «через час будет поздно», «срочно».

Цель: не дать жертве время для верификации. Именно поэтому правило:
Чем срочнее и нестандартнее запрос — тем тщательнее нужна верификация, а не наоборот.

Реальные срочные финансовые операции в нормальных организациях всегда предполагают верификацию — они не требуют обойти контроли «ради скорости». Это — тревожный сигнал, а не оправдание.
Как корпоративная культура защищает от дипфейкового мошенничества?
Ответ

Три уровня защиты:

1. Процессы: обязательная двухканальная верификация для финансовых операций выше порогового значения — независимо от статуса отправителя запроса.
2. Психологическая безопасность: сотрудник должен быть уверен: «я не понесу наказания за задержку верификации». Культура, где «нельзя задавать вопросы CEO», — уязвима.
3. Обучение: регулярные симуляции (как phishing-тренинги) — чтобы сотрудники умели применять протоколы, а не только знали о них теоретически.
ИИ-текст
Синтетический текст:
самый незаметный
ИИ-генерированный текст — наиболее сложная для обнаружения категория. Детекторы ненадёжны. Контекстуальная оценка важнее.
ХарактеристикаИИ-текстЧеловеческий текст
Структура Избыточно структурирован, много заголовков H2/H3 Органичная структура, подходящая под задачу
Язык Гладкий, без ошибок, стандартизированный Индивидуальный стиль, иногда с опечатками
Детали Обобщения, «много» без цифр, банальные примеры Конкретные примеры, специфические детали
Факты Возможны галлюцинации — несуществующие источники Факты либо верифицированы, либо очевидно отсутствуют
Позиция Часто избегает занять позицию, «с одной стороны… с другой» Личная позиция, готовность к несогласию
Надёжные признаки ИИ-происхождения
!
Несуществующие источники — главный маркер
Если текст содержит конкретные ссылки на исследования, статьи или цитаты — проверь их существование в Google Scholar или PubMed. ИИ часто генерирует правдоподобно звучащие, но несуществующие источники: верное название журнала + неверный год + неверные авторы + неверные страницы.

Это называется «галлюцинация» и является самым надёжным диагностическим признаком ИИ-текста при верификации.
раскрыть
!
Почему ИИ-детекторы ненадёжны
Инструменты типа GPTZero, Originality.ai, Turnitin AI дают значительный процент ложноположительных (обвиняют людей в ИИ-генерации) и ложноотрицательных (пропускают настоящий ИИ-текст) результатов.

Причины: детекторы обучены на моделях прошлых версий, новые модели избегают «паттернов детектирования», доработанный ИИ-текст обходит детекторы. Использовать как дополнительный индикатор, но не как решающий аргумент.
раскрыть
Цифровой арсенал
Инструменты
для обнаружения
Ни один инструмент не даёт 100% точности. Используй несколько в комбинации и опирайся на контекстуальную верификацию как главный метод.
⚠️
Критическое ограничение всех детекторов: инструменты обнаружения — всегда в отставании. Они обучаются на известных моделях, а новые модели выпускаются быстрее. Думай о детекторах как об одном из инструментов, а не как о решении проблемы.
Интеграция методов
SIFT для
синтетического контента
Методология SIFT применяется к дипфейкам с адаптацией каждого шага под особенности синтетического контента.
S · Stop — Особенности для синтетики
Дополнительные триггеры для S
Привычные триггеры + специфические для синтетики: (1) Изображение/видео эмоционально насыщено и вирусно (идеальные условия для дипфейка). (2) Контент дискредитирует публичную фигуру. (3) Контент появился в нестандартном источнике, а не в официальном аккаунте. (4) «Слишком удачное» совпадение с текущей повесткой.
I · Investigate — Источник публикации важнее содержания
Для синтетики: откуда это?
Lateral reading о публикующем аккаунте или сайте — даже если контент кажется «правдивым». Вопросы: Когда создан аккаунт? Что публиковал раньше? Это официальный аккаунт персоны или «фанатский»? Для видео: это загружено на канал самой персоны или «репостнуто» кем-то другим?
F · Find — Официальные источники персоны
Есть ли это на официальных площадках?
Если видео/аудио с публичной фигурой — нет ли этого на её официальных каналах (YouTube, официальный Twitter/X, сайт)? Упоминают ли надёжные издания этот инцидент? Если событие реальное — оно было бы освещено в Reuters/AP в течение часов. Если ни один надёжный источник не подтверждает — сильный красный флаг.
T · Trace — Обратный поиск и метаданные
Первая публикация и контекст
Обратный поиск картинки (Google Lens, TinEye) — когда и где появилось впервые? InVID/WeVerify для видео — поиск по ключевым кадрам, метаданные. Для ИИ-текста — проверь все источники, на которые ссылается материал, в PubMed или Google Scholar.
Практика · Комплексный кейс
Разберите ситуацию
по слоям
Применим весь арсенал темы к реальной рабочей ситуации. Нажимайте последовательно.
Рабочий кейс
Коллега присылает в корпоративный мессенджер видео: «Смотри — CEO нашей компании говорит в интервью, что планирует массовые сокращения в следующем квартале». Видео — 45 секунд, лицо и голос узнаваемы. Видео опубликовано на YouTube-канале «Бизнес-новости сегодня».
S
S — Stop: какие тревожные сигналы до просмотра?
Три красных флага: (1) Эмоционально заряженное содержание — затрагивает работу коллег. (2) Источник — «Бизнес-новости сегодня» (не официальный канал компании). (3) CEO крупной компании не делал бы такое заявление в непромаркированном интервью — это нарушило бы корпоративные протоколы. Пауза перед реакцией.
I
I — Investigate: что проверяем о YouTube-канале?
Lateral reading о канале: когда создан? Сколько подписчиков? Какие другие видео? Нет ли это «под» официальный канал? Поиск названия канала в поиске — есть ли жалобы? Является ли канал верифицированным (галочка YouTube)? Официальные каналы CEO обычно известны и перелинкованы с сайтом компании.
F
F — Find: ищем это в надёжных источниках
Поиск: «[имя CEO] сокращения [название компании] [текущий год]» в Яндексе, Google, Forbes, РБК. Если CEO реально сказал это в интервью — это бы уже было в деловых изданиях. Ничего не находим в авторитетных источниках → высоковероятный синтетический контент или вырванное из контекста.
T
T — Trace + визуальный анализ видео
InVID/WeVerify: загрузить URL → поиск по ключевым кадрам → найти, откуда взяты кадры. Замедление видео до 0.25×: граница лица при поворотах, синхрон губ, мигание. Также: найти оригинальное интервью CEO на официальном канале — скорее всего, лицо и голос взяты оттуда и наложены новые слова.
Вывод и действия
Решение: не распространять до верификации. Ответить коллеге: «Давай проверим — это не на официальном канале». Отправить PR/Коммуникациям компании ссылку на видео для официальной оценки. При подтверждении фейка — сообщить HR или руководству об активной дезинформационной кампании против компании.
🎯 Контрольный вопрос 3 + Итоговые
Финальная проверка
Детектор дипфейков показывает вероятность синтетического происхождения видео — 34%. Какой вывод правильно сделать?
А
Видео подлинное: вероятность синтеза мала (34% < 50%)
Б
Видео дипфейк: достаточно высокий процент для опровержения
В
Неопределённый результат: продолжить контекстуальную верификацию через SIFT
Г
Запустить ещё 5 детекторов — консенсус даст точный ответ
1. Почему «я узнаю этот голос / лицо» — ненадёжная верификация?
Разбор

По трём причинам:

1. Клонированный голос звучит как оригинал — это цель технологии. Если клонирование неотличимо, «узнавание» не информативно.
2. Когнитивное искажение: при ожидании услышать конкретный голос — слышишь его. Система 1 заполняет пробелы ожидаемым паттерном.
3. Face-swap не меняет лицо на незнакомое — он меняет его на другое, которое кажется правильным. «Узнавание» означает, что замена удалась.
2. Почему контекстуальная верификация надёжнее визуального анализа?
Разбор

Визуальный анализ: гонка вооружений. Новые модели устраняют известные артефакты. Список маркеров устаревает за месяцы. Человеческое восприятие — ненадёжный детектор.

Контекстуальная верификация: вопросы типа «Была ли эта встреча? Освещали ли Reuters/AP? Опубликовано ли на официальном канале?» — не зависят от качества синтеза. Даже идеальный дипфейк не меняет факт, что реальной встречи в Reuters не было.
3. Как связаны тема 3.3 и Модуль 2 (когнитивные искажения)?
Разбор

Синтетический контент эксплуатирует когнитивные искажения:

Эвристика доступности: яркий, эмоциональный дипфейк-контент «вспоминается» лучше — кажется реальнее.
Предвзятость подтверждения: дипфейк, подтверждающий существующие взгляды, меньше проверяется.
Эффект ореола: «узнаваемый голос/лицо» создаёт доверие ко всему сообщению.
Срочность и неприятие потерь: «срочный» запрос от «CEO» давит на принятие быстрого решения без верификации.
Резюме темы 3.3
Главное из темы
Синтетический контент — реальная угроза 2024–2025. Надёжная защита — контекстуальная верификация, а не попытка «увидеть» подделку.
🖼 Синтетические изображения
Проверяй контекст, не пиксели
Обратный поиск по картинке. Есть ли событие в Reuters? Несоответствия в деталях. Визуальный анализ — вспомогательный.
🎬 Видеодипфейки
Замедление + InVID + официальный канал
Границы лица, синхрон губ, маркеры при поворотах. Главное: есть ли это на официальном канале?
🎙 Аудиодипфейки
Двухканальная верификация всегда
Голос неотличим. Перезвони по официальному номеру. Срочность — красный флаг, не оправдание пропустить проверку.
📝 ИИ-текст
Верифицируй источники вручную
Детекторы ненадёжны. Главный маркер — несуществующие источники. Проверь все ссылки в PubMed/Scholar.
📋 Практическое задание темы 3.3
«Найдите в открытых источниках один пример дипфейка или синтетического контента (изображение, видео или аудио). Опишите: тип синтеза, технологию создания, маркеры обнаружения и как SIFT применяется к этому случаю».
1–2 страницы + ссылка на материал · Загрузите в систему · Подготовка к итоговому проекту 4.3
Модуль 3 завершён
SIFT (3.1) + CRAAP (3.2) + Дипфейки (3.3) → Тест №3 (70% порог)
➡️
Следующий модуль
Модуль 4 · Критическое мышление при работе с ИИ — LLM, промпты, итоговый проект
1 / 15