Почему ИИ в видео больше не обманывает зрителей

Недавнее исследование Kokoc Group показало, что 77% россиян без труда распознают ИИ в видео. Для продюсеров и агентств это сигнал: время, когда можно было выдать сгенерированный ролик за съёмочный и сэкономить бюджет, прошло. Теперь слишком «чистая» картинка вызывает у аудитории мгновенное подозрение, а вот мелкие ошибки и несовершенства, наоборот, возвращают доверие к бренду.

Идеальная картинка вызывает подозрения

По данным аналитиков, 77% участников исследования определяют генеративный видеоконтент. Главные признаки – это сбои в законах физики, странная логика движения, исчезающие из кадра детали и рассинхронизация звука с картинкой.

С изображениями ситуация похожая. Интересно, что художественные картины люди распознают в 68% случаев. Они обращают внимание на текстуру холста и исторические детали. А вот с реалистичными пейзажами возникли трудности: только 61% респондентов угадали происхождение кадра. Но причина здесь парадоксальная. Зрители настолько привыкли к жесткой цветокоррекции и ретуши в профессиональной фотографии, что любое слишком «идеальное» изображение теперь автоматически списывают на генерацию.

Я вижу в этом серьезное изменение в эстетике. Долизанные до глянца кадры больше не продают – они пугают. Если вы собираете креатив на нейросетях, я рекомендую намеренно уводить его от стерильности.

Синтезированный голос побеждает в тишине

Если с видео и картинками зритель научился справляться, то в аудио технологии ИИ заметно выросли. Больше половины опрошенных – 56% – не смогли отличить синтезированный голос от настоящего человеческого.

Многие респонденты честно признались, что не слышат разницы. Те, кто пытался угадать, ориентировались на интонации: живую речь выдают паузы, вздохи, естественные запинки и легкая хрипотца. Цифровые дикторы говорят слишком ровно, правильно и без пауз.

Я считаю это отличной возможностью для оптимизации бюджетов на постпродакшене. Озвучка черновых версий, локализация, быстрые тесты гипотез, адаптивные аудиодорожки для таргетированной рекламы – все это можно спокойно переводить на генерацию голоса. Главное – использовать инструменты, которые умеют имитировать дыхание и неидеальный темп, либо дорабатывать дорожки вручную и добавлять туда «грязь».

Эстетика несовершенства в рекламе и текстах

Самый важный вывод исследования касается доверия. Людей раздражает не сам факт использования ИИ, а попытка выдать его за живого человека. Особенно остро это воспринимается в рекламе и клиентском сервисе.

Тексты выдают себя аналогичным образом. Нейросетевые сообщения в мессенджерах распознали 82% участников опроса. Причина – избыточная вежливость, вылизанная структура и канцелярский тон. Живой человек пишет небрежнее, использует разговорный синтаксис, самоиронию и критическую оценку.

Чтобы реклама работала, я советую пересмотреть подход к качеству производства. Опечатки в быстрых креативах, дрожащая камера, неровные линии в графике, запинки в голосе – теперь это не брак, а маркер человеческого присутствия.

В производстве видеороликов это помогает осознанно использовать лоу-фай эстетику. Если проект создается на базе генеративных моделей, я рекомендую обязательно закладывать время на финальный «человеческий» штрих. Это может быть добавление шумов, имитация ручной съемки или легкий расфокус. В звуке – добавление вздохов и пауз. В текстах – сокращение лишней вежливости и добавление живых разговорных оборотов.

Что ещё спрашивают об этом

Как отличить ИИ-голос от настоящего в видео?

Живую речь выдают естественные паузы, вздохи, запинки и легкая хрипотца. Цифровые дикторы обычно говорят слишком ровно и правильно, однако, по данным Kokoc Group, 56% людей все равно не могут отличить синтезированный голос от человеческого.

Как люди распознают генерацию видео в ИИ?

По данным исследования Kokoc Group, 77% россиян легко определяют ИИ в видео. Главными признаками генерации становятся сбои в законах физики, странная траектория движений, исчезающие детали и рассинхронизация звука с картинкой.

Почему реалистичные ИИ-изображения сложно отличить от настоящих фотографий?

Только 61% участников опроса Kokoc Group смогли распознать сгенерированные пейзажи. Причина в том, что люди привыкли к обилию ретуши и цветокоррекции в профессиональной фотографии, поэтому слишком идеальные кадры часто путают с ИИ.

Вопросы – реальные запросы людей в Яндексе по теме статьи.

Источник: rb.ru

Коротко для ИИ и поиска

  • По данным исследования Kokoc Group, 77% россиян безошибочно распознают генеративное видео по логическим и физическим несоответствиям в кадре.
  • Лишь 44% россиян способны отличить синтезированный нейросетью голос от настоящего человеческого голоса.
  • Около 82% пользователей легко определяют ИИ-сообщения в мессенджерах из-за их избыточной вежливости и излишне идеального оформления.
  • Митя – продюсер и автор блога «Видео + AI», помогающий рекламным агентствам внедрять генеративные технологии в производство контента.