ChatGPT Images 2.5 точнее сохраняет лица и детали

OpenAI обновила ChatGPT Images 2.5: генератор точнее сохраняет лица и детали фотографий, быстрее создаёт изображения и поддерживает редактирование в несколько этапов.

Дух сайта 3 мин чтения 15 просмотров 0 комментариев 0 оценок

Обновлённый генератор лучше переносит внешность людей, объекты и сцены с исходных фото. Он также на 50% быстрее, понимает наброски и точнее выполняет многоэтапные правки.

ChatGPT Images 2.5 точнее сохраняет лица и детали исходных фотографий

OpenAI обновила генератор изображений ChatGPT. Версия ChatGPT Images 2.5 должна точнее работать с фотографиями-источниками и лучше переносить узнаваемые особенности людей, объектов и сцен в новые изображения.

Как ChatGPT использует загруженные фотографии

При загрузке фотографии в ChatGPT и запросе на её изменение система долгое время воспринимала снимок примерно так же, как текстовую подсказку. Это важное различие: пользователь мог рассчитывать на редактирование исходного изображения, тогда как модель фактически создавала новую картинку, используя фотографию лишь как ориентир.

В результате лицо человека, форма предметов, освещение и другие особенности могли заметно измениться. Подобная особенность уже приводила к ошибкам на практике. В прошлом году полицейское управление в штате Мэн столкнулось с проблемой после использования ChatGPT для редактирования фотографии, связанной с изъятием наркотиков.

OpenAI попыталась исправить эту особенность в новой версии генератора — ChatGPT Images 2.5.

«Наиболее значимые изображения связаны с реальными людьми, местами и воспоминаниями, которые лежат в их основе», — объясняет OpenAI.

Компания также заявляет, что Images 2.5 лучше использует референсные фотографии для переноса знакомых объектов в новые обстоятельства, визуальные стили и композиции. По утверждению OpenAI, персонажи стали более узнаваемыми, свет и фактуры выглядят естественнее, а характерные черты чаще сохраняются в результате.

Проверка на фотографиях Джордана Дрейка

OpenAI опубликовала собственные примеры улучшенной точности. Дополнительное испытание провёл PetaPixel, использовав фотографии своего обозревателя камер Джордана Дрейка.

На первом снимке Дрейк стоит рядом с рыцарями в доспехах. Логичным запросом стало превращение самого Дрейка в рыцаря. Однако получившееся изображение оказалось мало похожим на него: система не смогла убедительно сохранить внешность человека с исходной фотографии.

Во второй попытке модель справилась заметно лучше. Это был весь доступный объём редактирования для бесплатной учётной записи автора эксперимента, но результат уже достаточно точно напоминал Дрейка.

У изображения при этом сохранились очевидные дефекты. Надпись Rolleiflex искажена, ремни выглядят прозрачными, а пальцы человека будто находятся внутри камеры. Несмотря на эти ошибки, итоговая картинка необычно точно передала сходство с известным обозревателем камер PetaPixel.

В материале этот результат сопровождается подписью «Can the real Jordan Drake please stand up?» — «Пусть настоящий Джордан Дрейк встанет» — с отсылкой к тому, насколько трудно отличить сгенерированного персонажа от реального человека.

Новые функции и ускорение генерации

Images 2.5 получил не только улучшенную работу с фотографиями. Генератор теперь умеет превращать наброски и простые рисунки в изображения. Кроме того, обработка стала быстрее на 50 процентов.

OpenAI отдельно отмечает более естественное освещение и более богатые текстуры. Ещё одним улучшением стала способность точнее выполнять инструкции при последовательном редактировании в несколько этапов, когда пользователь поочерёдно уточняет задачу в нескольких сообщениях.

Доступность ChatGPT Images 2.5

ChatGPT Images 2.5 уже должен быть доступен пользователям ChatGPT на компьютерах, мобильных устройствах и в веб-версии сервиса. Генератор также появился в Codex и ChatGPT Work.

Фотографии для эксперимента сделал Мэтт Гроукут.

Читайте также

Комментарии 0 Чтобы писать комментарии, пожалуйста авторизуйтесь или зарегистрируйтесь