OpenAI Unveils ChatGPT Images 2.5 with Faster Generation and Enhanced Precision
OpenAI выпустила обновлённую версию модели для генерации изображений — ChatGPT Images 2.5. Новая архитектура обещает сократить задержку обработки запросов на до 50 % по сравнению с предыдущей версией Images 2.0 и предлагает улучшенную работу с текстурами, освещением и сохранение консистентности объектов при многократных правках.
Главное техническое изменение касается точности интерпретации промптов и работы с референсами. Модель теперь лучше передаёт детали из исходных изображений, что позволяет пользователям редактировать конкретные элементы (например, одежду или фон) без потери целостности общего стиля. Для упрощения работы введены новые инструменты: функция Sketch позволяет использовать простые эскизы или контуры как визуальную основу для генерации, а библиотека Templates предлагает готовые шаблоны для создания постеров, мерча и коммерческих фото.
Разработчики также добавили возможность оставлять комментарии прямо на изображении для точечной доработки результата. При совместном использовании промпт можно передавать другим пользователям, чтобы они создавали свои вариации на основе исходного запроса и фотографий. Доступ к модели предоставляется через интерфейс ChatGPT, ChatGPT Work и Codex на десктопах, мобильных устройствах и в веб-браузере для всех тарифных планов.
Для программистов OpenAI открыла два специализированных API-модуля: GPT-Image-2.5 Flare — быстрое стандартное решение для массовой генерации, и GPT-Image-2.5 Sunburst — модель для сложных творческих задач, требующая больше времени на обработку. Оба варианта поддерживают входные данные в виде текста и изображений, а также работу через Images-API. Стоимость использования составляет 8 долларов США за миллион входных токелей и 30 долларов за миллион выходных.
Повышенная детализация изображения одновременно увеличивает риски создания убедительных дипфейков. В связи с этим OpenAI внедряет многослойную систему проверки промптов и загружаемых файлов, а также планирует добавлять к результатам метаданные и невидимые водяные знаки для маркировки контента.