Компания OpenAI объявила о запуске новой версии генератора изображений. Обновление получило название ChatGPT Images 2.5. Соответствующий пост появился на официальном блоге компании. Разработчики также раскрыли впечатляющую статистику использования технологии. Через API модели ChatGPT Images и GPT-Image еженедельно создают свыше трёх миллиардов изображений.
По заявлению компании, обновление затронуло сразу четыре ключевых направления. Первое улучшение касается более реалистичного освещения и текстур материалов. Итоговая картинка теперь ближе напоминает настоящую фотографию. Второе изменение улучшило перенос объектов с референсных фотографий. Модель лучше сохраняет узнаваемость персонажа при смене сцены, стиля или композиции. Третье улучшение затронуло точность редактирования изображений. Теперь модель меняет только указанную пользователем часть картинки. Остальные детали изображения остаются нетронутыми при редактировании.
Четвёртое улучшение касается работы модели в многоходовых диалогах. Прежние правки теперь сложнее случайно перезаписать последующими инструкциями. Качество картинки больше не деградирует при серии последовательных изменений. Модель также стала точнее интерпретировать сложные визуальные инструкции. Речь идёт о запросах с прозрачным фоном или конкретным художественным стилем. Соответствие результата таким запросам заметно выросло. На стороне генерации задержка снизилась максимум на 50 процентов по сравнению с версией Images 2.0.
Приложение ChatGPT одновременно получило набор новых инструментов. Функция Sketch позволяет рисовать эскиз прямо в диалоговом окне. Пользователь добавляет описание стиля, а модель дорабатывает изображение на основе наброска. Функция вызывается командой «@Sketch» в диалоге. Инструмент Templates предлагает готовые шаблоны для постеров и товарных изображений. Функция комментирования изображений позволяет закреплять правки прямо на конкретной части картинки. При отправке изображения теперь можно поделиться и самим запросом. Другой пользователь сможет заменить своё изображение и детали, используя тот же запрос.
Для разработчиков OpenAI выпустила две новые модели через API. Модель GPT-Image-2.5 Flare предназначена для большинства сценариев использования. По сравнению с GPT-Image-2 задержка снизилась на 50 процентов при более высоком качестве картинки. Модель подходит для создания контента, товарных изображений, визуального поиска и массовой генерации. Вторая модель, GPT-Image-2.5 Sunburst, ориентирована на творческие и монтажные процессы с высоким контролем результата. Ранний клиент Higgsfield AI отметил на официальной странице сильную сторону модели Flare. По его словам, модель понимает, что именно не следует менять при редактировании. Такой подход сохраняет персонажей, композицию и визуальные особенности исходного изображения.
Обновление ChatGPT Images 2.5 уже доступно всем пользователям ChatGPT, ChatGPT Work и Codex. Функция работает на всех уровнях подписки. Доступ открыт на десктопе, мобильных устройствах и в веб-версии. Модели Flare и Sunburst одновременно стали доступны и через API.
