OpenAI представила ChatGPT Images 2.5 — новую модель для генерации и редактирования изображений. Она лучше сохраняет людей и объекты с исходных фотографий, точнее меняет отдельные детали и создает картинки до 50% быстрее предыдущей версии. Пользователи ChatGPT и разработчики сейчас генерируют через инструменты OpenAI больше 3 млрд изображений в неделю.

Раньше при последовательных правках генератор мог случайно менять детали, которые пользователь просил оставить нетронутыми, или постепенно ухудшать исходную композицию. В Images 2.5 OpenAI сосредоточилась на сохранении изображения между правками: модель сможет, например, заменить товар, фон или текст, не меняя человека, расположение объектов и общий стиль картинки.
Модель стала точнее работать и с референсами. Она лучше сохраняет узнаваемые черты людей и объектов, естественнее передает свет и текстуры и увереннее справляется со сложными композициями и прозрачным фоном. По словам OpenAI, это позволит создавать серии рекламных материалов или визуалы для презентаций, не теряя заданный стиль после каждой новой команды.
В самом ChatGPT появились новые инструменты для работы с изображениями. Функция Sketch позволит нарисовать простую схему или набросок прямо в чате, после чего модель превратит его в готовое изображение. Пользователи смогут оставлять комментарии прямо на картинке для точечных изменений, выбирать шаблоны для постеров и товаров, а при публикации изображения — делиться исходной командой с другими людьми.
Для разработчиков OpenAI выпустила две версии модели. GPT-Image-2.5 Flare предназначена для большинства задач и работает с задержкой на 50% ниже GPT-Image-2, а GPT-Image-2.5 Sunburst рассчитана на более тщательную работу, где важнее точность, чем скорость. Обе модели можно подключать к своим продуктам через программный интерфейс OpenAI.
ChatGPT Images 2.5 уже начинает появляться у пользователей всех тарифов ChatGPT, а также в ChatGPT Work и Codex на компьютерах, смартфонах и в браузере.
Источник: OpenAI