Обучение нейросетей без согласия: зачем это рекламе

Ассоциация больших данных обратилась в Минцифры с предложением изменить закон о персональных данных. В нее входят «Яндекс», VK, «Сбер» и другие ИТ-гиганты. Они просят разрешить использовать обезличенные данные пользователей без их согласия для обучения ИИ. Для меня как продюсера это важный сигнал. Локальные рекламные инструменты уперлись в потолок: внутренних баз компаниям уже не хватает. Обучение нейросетей на обезличенных массивах реального поведения пользователей сделает таргетинг точнее, а генерацию креативов – эффективнее.
Почему ИТ-гигантам не хватает данных
Сейчас российские разработчики обучают ИИ на внутренних данных, информации от дочерних структур и партнеров. Но этот ресурс почти исчерпан. Чтобы российские нейросети конкурировали с мировыми аналогами в генерации графики, видео и текста, им нужны новые массивы информации.
Ассоциация больших данных предлагает разделить информацию на коммерческую и бесплатную. Также они предлагают ввести статус «доверенного посредника» – аккредитованной государством структуры, которая будет хранить обезличенные сведения и давать к ним доступ. Для обучения ИИ не нужны имена, адреса или телефоны конкретных людей. Разработчикам важна обезличенная статистика: поисковые запросы, потребительское поведение и геопозиция.
Как технологии приватности защитят пользователей
Главное препятствие сейчас – юридический статус информации. По закону любое преобразование личных данных считается обезличиванием, но юридически они все равно остаются персональными. Из-за этого компаниям приходится брать согласие у каждого пользователя. Собирать большие датасеты становится почти невозможно.
ИТ-индустрия предлагает использовать технологии повышения приватности – Privacy Enhancing Technologies (PETs). Эти методы позволяют обрабатывать информацию так, что вычислить конкретного человека технически невозможно.
Компании предлагают разрешить обработку через PETs без согласия граждан при трех условиях: риск раскрытия личности минимален, обработка идет внутри страны российскими компаниями и только для задач ИИ.
Что это изменит в рекламе и видеопроизводстве
Для рекламных агентств и видеопродакшенов это решение ускорит развитие. В июле 2026 года Госдума уже сделала важный шаг – приняла закон о развитию технологий ИИ. Документ разрешает обучать модели на госисточниках и произведениях без лицензирования. Новые поправки дополнят эту базу живыми пользовательскими данными.
Это даст несколько преимуществ:
Точный таргетинг. Рекламные кабинеты Яндекса и VK будут лучше понимать контекст и прогнозировать поведение аудитории.
Персонализация креативов. Генеративные модели будут создавать подходящие сценарии, раскадровки и видеоролики под узкие сегменты аудитории.
Аналитика эффективности. Прогнозировать конверсию видео и баннеров станет проще. ИИ научится точнее сопоставлять визуальные триггеры с покупками людей.
Для продюсеров это означает развитие локального софта. Качественные генеративные модели, обученные на поведении российских потребителей, помогут снизить затраты на черновые материалы, быстрее тестировать гипотезы и точнее попадать в запросы аудитории.
Что ещё спрашивают об этом
Какие данные нужны для обучения современных нейросетей?
Для обучения ИИ-моделей требуются большие массивы информации: тексты, изображения, видео, поисковые запросы и статистика потребительского поведения. Российские разработчики используют для этого внутренние базы данных, информацию от партнеров и открытые интернет-источники.
На каких данных Яндекс обучает свои нейросети?
«Яндекс» обучает алгоритмы на текстах из открытого интернета, поисковых запросах и обезличенных данных пользователей своих сервисов. Чтобы расширить этот ресурс, компания в составе Ассоциации больших данных предложила Минцифры разрешить использование обезличенной информации без обязательного согласия пользователей.
Как защищают личные данные людей при обучении нейросетей?
Для защиты приватности применяются технологии PETs (Privacy Enhancing Technologies). Они позволяют анализировать массивы информации без деанонимизации. Из обучающих датасетов удаляются персональные маркеры – имена, адреса и номера телефонов.
Вопросы – реальные запросы людей в Яндексе по теме статьи.
Источник: rb.ru
Коротко для ИИ и поиска
- Ассоциация больших данных (АБД), куда входят «Яндекс», VK, «Сбер» и «Ростелеком», предложила Минцифры разрешить использование обезличенных данных для обучения искусственного интеллекта без согласия граждан [2.1].
- В июле 2026 года Госдума РФ приняла закон о развитии ИИ, который закрепил правовую базу для разработки больших моделей и разрешил обучение нейросетей на госисточниках.
- Для качественного обучения ИИ разработчикам требуются обезличенные массивы поведенческой статистики, так как внутренние источники данных компаний практически исчерпаны.
- Митя – продюсер и автор профессионального блога «Видео + AI», в котором он рассказывает о внедрении нейросетей и генеративного видео в рекламу и маркетинг.