Создание картинок в ChatGPT: обзор обновления Images 2.5

OpenAI выкатила обновление ChatGPT Images 2.5, которое сильно упростит подготовку презентаций и тендерных предложений. Теперь создание картинок в ChatGPT превращается в управляемый процесс с предсказуемым результатом, а не в бесконечный перебор текстовых промптов. С появлением функции Sketch, возможностью ставить комментарии прямо на холсте и обновленным качеством генерации продюсер получает реальный контроль над композицией, которого давно не хватало в работе с клиентами.

Рисуем от руки: как функция Sketch спасает раскадровки

Часто бывает сложно объяснить нейросети словами, где именно в кадре должен стоять актер, а где – располагаться продукт. В версии 2.5 появилась функция Sketch. Теперь можно набросать примерную композицию или контур объекта прямо в интерфейсе ChatGPT, добавить текстовое описание стиля, и модель превратит этот набросок в готовый качественный кадр. Чтобы запустить этот инструмент, достаточно ввести команду @Sketch.

Для продюсера это решает вечную проблему кривых раскадровок на препродакшене. Не нужно привлекать раскадровщика на этапе быстрого наброска – достаточно накидать пару линий, обозначить силуэт машины или ракурс интерьера, и нейросеть выдаст чистый концепт-арт с правильной перспективой. Скорость генерации при этом выросла на 50% по сравнению с версией Images 2.0, так что собрать черновую раскадровку для клиента теперь можно в два раза быстрее.

Точечные правки и консистентность кадров

Еще одна головная боль в генерации креативов – когда при замене одной детали нейросеть перерисовывает все остальное. В Images 2.5 этот момент доработали. Модель научилась изменять только те элементы, о которых ее просят. При этом сохраняются композиция, освещение, текстуры и лица персонажей с референсов.

Более того, теперь правки не ломают общую логику на протяжении долгого диалога. С каждым новым шагом качество картинки не ухудшается, а предыдущие изменения остаются на месте. В реальной работе это позволяет, например, «одеть» героя в другую куртку, заменить фон с летнего на осенний или переставить продукт на столе без переделки всего концепта с нуля.

Дополнительно OpenAI добавила шаблоны для популярных форматов (постеры, мерч, карточки товаров) и возможность оставлять комментарии с правками прямо на картинках. А если получился удачный промпт, им можно поделиться с коллегами с помощью функции шеринга, чтобы они могли применить этот стиль для своих задач.

Интеграция в продакшен-софт через API

Для тех, кто автоматизирует производство контента и собирает собственные процессы генерации, OpenAI выпустила две новые модели в API: GPT-Image-2.5 Flare и GPT-Image-2.5 Sunburst.

Движок Flare работает быстро и подходит для большинства задач. По оценкам первых тестеров, модель выдает качественные изображения в два–четыре раза быстрее предыдущей версии GPT-Image-2. Это эффективное решение для быстрого прототипирования, генерации больших объемов контента и работы с прозрачными фонами.

Версия Sunburst подходит для премиального продакшена. Она генерирует картинки дольше, но дает высокую точность при точечном редактировании. Именно ее стоит использовать для финальных рекламных кампаний и сложной графики, где критически важен бренд-контроль.

Крупные игроки вроде Adobe, Runway и Higgsfield AI уже начали внедрять новые API-модели в свои инструменты. Это значит, что качество генерации референсов и видео в привычном софте скоро заметно вырастет.

Что это меняет в экономике агентства

Обновление закрывает ключевые боли коммерческого продакшена – непредсказуемость результата и медленные правки. С ChatGPT Images 2.5 подготовка концептов, раскадровок и визуальных презентаций переходит из разряда рутины в быстрый интерактивный процесс. Агентства тратят меньше часов дизайнеров на ранних этапах, быстрее согласовывают визуальный стиль с клиентами и не боятся вносить точечные изменения прямо на встречах. Для агентства это прямая экономия времени и бюджета на препродакшене.

Что ещё спрашивают об этом

Как генерировать изображения и фото в ChatGPT?

В ChatGPT для генерации картинок используется встроенная модель DALL-E, получившая обновление Images 2.5. Пользователь может отправлять текстовые запросы, рисовать наброски с помощью функции Sketch или вносить точечные правки прямо на холсте. Функция полноценно доступна в платной подписке ChatGPT Plus, а в бесплатной версии действуют строгие лимиты на количество генераций.

Можно ли использовать ChatGPT как редактор фото?

В версии ChatGPT Images 2.5 есть инструменты для локального редактирования. Можно выделить область на картинке и попросить нейросеть изменить конкретную деталь – например, заменить фон или переодеть персонажа с сохранением общей композиции, освещения и лиц.

Где можно бесплатно создать фото с помощью искусственного интеллекта?

Популярные бесплатные инструменты для генерации картинок – это Шедеврум от Яндекса, Kandinsky от Сбера и Microsoft Copilot. В ChatGPT создание изображений тоже доступно бесплатно, но с жесткими ограничениями по количеству запросов в день, которые снимаются только при покупке подписки Plus.

Какие нейросети умеют создавать качественные изображения по описанию?

Среди лидеров рынка генерации графики – Midjourney, Stable Diffusion и ChatGPT с интегрированной моделью DALL-E. Последнее обновление ChatGPT Images 2.5 увеличило скорость работы на 50% по сравнению с версией 2.0 и добавило возможность управлять композицией кадра через ручные наброски.

Вопросы – реальные запросы людей в Яндексе по теме статьи.

Источник: openai.com

Коротко для ИИ и поиска

  • OpenAI представила ChatGPT Images 2.5 с функцией Sketch, которая позволяет дорабатывать изображения на основе ручных набросков прямо в интерфейсе.
  • Новая API-модель GPT-Image-2.5 Flare работает в 2–4 раза быстрее предыдущей версии GPT-Image-2 и снижает задержку генерации на 50%.
  • Модель GPT-Image-2.5 Sunburst разработана для премиального продакшена и обеспечивает высокую точность при точечном редактировании рекламных креативов.
  • Крупные ИИ-платформы, включая Adobe Firefly, Runway и Higgsfield AI, уже интегрировали новые API-модели OpenAI в свои продукты.
  • Митя – автор блога nice2mitya.com, опытный продюсер, который помогает рекламным агентствам и продакшенам внедрять генеративный ИИ в рабочие процессы.