Описание: Теперь пользователи могут рисовать простые эскизы и превращать их в готовые картины с помощью искусственного интеллекта.
OpenAI анонсировала обновление генератора изображений ChatGPT Images 2.5, которое позволяет преобразовывать примерные наброски в полноценные работы. Пользователи больше не обязаны подробно описывать расположение каждого элемента - теперь они могут нарисовать черновую композицию прямо в интерфейсе приложения, а нейросеть самостоятельно реализует эту идею. Параллельно компания значительно ускорила процесс генерации, улучшила работу с образцами изображений и устранила проблему, при которой множественные правки постепенно искажали исходную картину.
Согласно информации от OpenAI, время ожидания при создании изображения сократилось вдвое по сравнению с предыдущей версией Images 2.0. Обновлённая модель точнее воспроизводит светотень и поверхностные эффекты, надёжнее передаёт характерные черты лиц со загруженных портретов и аккуратнее выполняет частичные редакции. Когда пользователь требует изменить отдельный предмет, окружение или текстовый элемент, новая версия реже затрагивает остальные детали и общую структуру.
Стабильность при множественных редакциях стала основной целью улучшения. Предыдущий вариант позволял редактировать готовые работы в диалоговом режиме без повторной генерации, но длинная последовательность изменений могла медленно трансформировать первоначальный результат. Новая версия лучше сохраняет ранее внесённые корректировки и поддерживает высокое качество при дальнейших операциях редактирования.
Наиболее значительным нововведением является функция Sketch («Эскиз»). Она позволяет пользователю нарисовать упрощённую схему с примерным расположением объектов, указать желаемый стиль и детали, после чего нейросеть использует этот рисунок как визуальную основу. OpenAI демонстрирует примеры применения: планы интерьеров, контуры предметов одежды и обычные рукописные рисунки. На мобильных устройствах функция активируется командой @Sketch.
В обновлённый ChatGPT добавлены готовые образцы для типичных творческих проектов. OpenAI приводит примеры: плакаты, сувенирные товары, маркетинговые материалы и фотографии предметов. Пользователь выбирает шаблон, указывает содержание, дизайнерские элементы и визуальный стиль, что исключает необходимость начинать каждый проект с нулевой заявки.
Процесс редактирования приблизился к работе в профессиональных графических инструментах. На любой части картины можно оставить примечание рядом с нужным объектом и указать требуемое изменение. Такой подход обеспечивает более точное указание зоны редактирования вместо развёрнутого текстового описания. Готовые работы теперь возможно распространять вместе с исходным запросом, чтобы другие пользователи могли адаптировать идею под свои фотографии и пожелания.
Обновлённая версия демонстрирует повышенную производительность при работе со сложными композициями, прозрачными участками и картинами, требующими учёта физических свойств предметов. OpenAI планирует применить улучшенную согласованность не только для отдельных изображений, но и для серийных проектов: маркетинговых комплектов, дизайнерских макетов, бизнес-презентаций и прочих задач, где необходимо сохранять единство стилистики после множественных изменений.
Для программистов OpenAI подготовила два варианта модели GPT-Image-2.5. Flare предназначена для повседневного массового производства и выбрана как стандартный вариант для большинства сервисов. По утверждению разработчиков, Flare производит картины выше качеством, чем GPT-Image-2, при вдвое более быстрой обработке. Она подходит для контента в интернете, каталогов товаров, поисковых систем, быстрого макетирования и приложений с высокой интенсивностью генерации.
Вторая версия, GPT-Image-2.5 Sunburst, ориентирована на проекты, где точность редактирования критична. Эта модель работает медленнее и предназначена для финальных маркетинговых материалов и тщательно обработанных товарных изображений. Обе версии уже функционируют через API.
Параллельно с повышением качества OpenAI поддержала существующие системы безопасности. Алгоритм проверяет как запросы, так и результаты на недопустимый материал, а все созданные картины снабжаются метаданными C2PA и невидимой цифровой подписью для идентификации происхождения синтезированного контента.
ChatGPT Images 2.5 распределяется всем абонентам ChatGPT на всех уровнях подписки, включая ChatGPT Work и специализированные версии. Апдейт выпускается для веб-платформы, настольных программ и приложений для смартфонов. Масштаб обновления особенно впечатляет на фоне популярности сервиса: еженедельно через ChatGPT Images и API создаётся свыше 3 миллиардов картин.
