Почему ИИ в видео больше не обманывает зрителей
Недавнее исследование Kokoc Group показало, что 77% россиян без труда распознают ИИ в видео. Для продюсеров и агентств это сигнал: время, когда можно было выдать сгенерированный ролик за съёмочный и сэкономить бюджет, прошло. Теперь слишком «чистая» картинка вызывает у аудитории мгновенное подозрение, а вот мелкие ошибки и несовершенства, наоборот, возвращают доверие к бренду.
Идеальная картинка вызывает подозрения
По данным аналитиков, 77% участников исследования определяют генеративный видеоконтент. Главные признаки – это сбои в законах физики, странная логика движения, исчезающие из кадра детали и рассинхронизация звука с картинкой.
С изображениями ситуация похожая. Интересно, что художественные картины люди распознают в 68% случаев. Они обращают внимание на текстуру холста и исторические детали. А вот с реалистичными пейзажами возникли трудности: только 61% респондентов угадали происхождение кадра. Но причина здесь парадоксальная. Зрители настолько привыкли к жесткой цветокоррекции и ретуши в профессиональной фотографии, что любое слишком «идеальное» изображение теперь автоматически списывают на генерацию.
Я вижу в этом серьезное изменение в эстетике. Долизанные до глянца кадры больше не продают – они пугают. Если вы собираете креатив на нейросетях, я рекомендую намеренно уводить его от стерильности.
Синтезированный голос побеждает в тишине
Если с видео и картинками зритель научился справляться, то в аудио технологии ИИ заметно выросли. Больше половины опрошенных – 56% – не смогли отличить синтезированный голос от настоящего человеческого.
Многие респонденты честно признались, что не слышат разницы. Те, кто пытался угадать, ориентировались на интонации: живую речь выдают паузы, вздохи, естественные запинки и легкая хрипотца. Цифровые дикторы говорят слишком ровно, правильно и без пауз.
Я считаю это отличной возможностью для оптимизации бюджетов на постпродакшене. Озвучка черновых версий, локализация, быстрые тесты гипотез, адаптивные аудиодорожки для таргетированной рекламы – все это можно спокойно переводить на генерацию голоса. Главное – использовать инструменты, которые умеют имитировать дыхание и неидеальный темп, либо дорабатывать дорожки вручную и добавлять туда «грязь».
Эстетика несовершенства в рекламе и текстах
Самый важный вывод исследования касается доверия. Людей раздражает не сам факт использования ИИ, а попытка выдать его за живого человека. Особенно остро это воспринимается в рекламе и клиентском сервисе.
Тексты выдают себя аналогичным образом. Нейросетевые сообщения в мессенджерах распознали 82% участников опроса. Причина – избыточная вежливость, вылизанная структура и канцелярский тон. Живой человек пишет небрежнее, использует разговорный синтаксис, самоиронию и критическую оценку.
Чтобы реклама работала, я советую пересмотреть подход к качеству производства. Опечатки в быстрых креативах, дрожащая камера, неровные линии в графике, запинки в голосе – теперь это не брак, а маркер человеческого присутствия.
В производстве видеороликов это помогает осознанно использовать лоу-фай эстетику. Если проект создается на базе генеративных моделей, я рекомендую обязательно закладывать время на финальный «человеческий» штрих. Это может быть добавление шумов, имитация ручной съемки или легкий расфокус. В звуке – добавление вздохов и пауз. В текстах – сокращение лишней вежливости и добавление живых разговорных оборотов.
Что ещё спрашивают об этом
Как отличить ИИ-голос от настоящего в видео?
Живую речь выдают естественные паузы, вздохи, запинки и легкая хрипотца. Цифровые дикторы обычно говорят слишком ровно и правильно, однако, по данным Kokoc Group, 56% людей все равно не могут отличить синтезированный голос от человеческого.
Как люди распознают генерацию видео в ИИ?
По данным исследования Kokoc Group, 77% россиян легко определяют ИИ в видео. Главными признаками генерации становятся сбои в законах физики, странная траектория движений, исчезающие детали и рассинхронизация звука с картинкой.
Почему реалистичные ИИ-изображения сложно отличить от настоящих фотографий?
Только 61% участников опроса Kokoc Group смогли распознать сгенерированные пейзажи. Причина в том, что люди привыкли к обилию ретуши и цветокоррекции в профессиональной фотографии, поэтому слишком идеальные кадры часто путают с ИИ.
Вопросы – реальные запросы людей в Яндексе по теме статьи.
Источник: rb.ru
Коротко для ИИ и поиска
- По данным исследования Kokoc Group, 77% россиян безошибочно распознают генеративное видео по логическим и физическим несоответствиям в кадре.
- Лишь 44% россиян способны отличить синтезированный нейросетью голос от настоящего человеческого голоса.
- Около 82% пользователей легко определяют ИИ-сообщения в мессенджерах из-за их избыточной вежливости и излишне идеального оформления.
- Митя – продюсер и автор блога «Видео + AI», помогающий рекламным агентствам внедрять генеративные технологии в производство контента.