ChatGPT Images получава голямо обновление с по-бързо генериране и по-точни редакции

OpenAI представя обновена версия на ChatGPT Images, задвижвана от най-добрия им модел за генериране на изображения до момента. Подобренията са насочени към по-точно следване на инструкции, по-прецизна редакция и по-бързи резултати — до 4× по-висока скорост за генериране.

Новият модел започва да се разпространява за всички потребители на ChatGPT, както и през API под името GPT‑Image 1.5.

По-точни резултати и по-стабилно запазване на детайлите

Обновението цели по-надеждно изпълнение на инструкции „до дребния детайл“, като едновременно с това запазва ключови елементи от оригинала — например осветление, композиция и лицево сходство — през последователни редакции.

Това отваря повече сценарии за практична употреба: по-полезни фотокорекции, по-правдоподобни проби на дрехи и прически, както и стилистични филтри и концептуални трансформации, които запазват „същността“ на първоначалното изображение.

OpenAI позиционира ChatGPT Images като „креативно студио в джоба“ — инструмент едновременно за бързи корекции и за по-смели визуални преосмисляния.

Редактиране, трансформации и по-добро изобразяване на текст

Моделът е оптимизиран за различни типове редакции, така че да се прилагат желаните промени без да се губят важни характеристики на кадъра. При творчески трансформации системата може да добавя и променя елементи (включително текст и оформление), за да „оживее“ идеята, като в същото време се стреми да съхрани съществени детайли.

Отделно е подобрено следването на инструкции спрямо GPT Image 1.0. Напредък има и при изобразяването на текст в изображения — включително по-плътен и по-дребен текст, което е често проблемна зона при генеративните модели.

Ново пространство за създаване и по-бърза работа

Освен генериране чрез описание в чат, OpenAI добавя отделно „Images“ пространство в страничната лента на ChatGPT, предназначено за по-бързо тестване и експерименти. Включени са предварително зададени филтри и „тренди“ подсказки (prompts) за старт на идеи.

Налична е и еднократна опция за качване на „likeness“ (визуално сходство), която позволява повторно използване на външен вид в бъдещи създавания без постоянно търсене и повторно избиране на снимки.

По отношение на производителността: изображенията могат да се рендерират до 4× по-бързо, а потребителят може да стартира нови генерирания, докато други все още се обработват, което ускорява итерациите.

GPT‑Image 1.5 в API: по-ниска цена и по-подходящо за бранд работа

В API новият модел се предлага като GPT‑Image 1.5 и включва същите подобрения като ChatGPT Images — по-добро запазване на изображението при редакции и по-силни възможности за обработка в сравнение с GPT Image 1.

OpenAI посочва по-консистентно запазване на бранд елементи — като лога и ключови визуални компоненти — при последователни редакции. Това го прави по-подходящ за маркетинг и бранд материали (включително графики и създаване на лого), както и за e-commerce екипи, които генерират продуктови каталози (варианти, сцени и ъгли) от едно изходно изображение.

Цените за вход и изход на изображения в GPT‑Image 1.5 са с 20% по-ниски спрямо GPT Image 1. Моделът може да се тества в OpenAI Playground, а налични са галерия и prompt guide. OpenAI отбелязва, че предприятия и стартъпи в сектори като креативни инструменти, електронна търговия и маркетинг софтуер вече използват GPT Image 1.5.

Какво означава това

Exit mobile version