OpenAI презентувала нове покоління генерації зображень — ChatGPT Images 2.5. Компанія заявляє про підвищення якості, точніше виконання інструкцій, стабільніше редагування та скорочення часу генерації. Одночасно в ChatGPT з’явилися нові інструменти, які спрощують роботу із зображеннями.
За даними OpenAI, користувачі ChatGPT Images і моделей GPT-Image через API щотижня створюють понад 3 мільярди зображень. Версія 2.5 має зробити цей процес швидшим і дати користувачам більше контролю над результатом.
Менше змін там, де їх не просили
Одним із головних оновлень стала точність редагування.
Images 2.5 краще розуміє, яку саме частину зображення потрібно змінити, і намагається залишати решту без змін. Наприклад, користувач може попросити замінити фон, одяг, окремий предмет або напис, не перегенеровуючи всю сцену.
При цьому модель краще зберігає:
- зовнішність людей;
- композицію;
- освітлення;
- текстури;
- ключові об’єкти;
- загальний стиль оригінального зображення.
Це особливо важливо під час роботи з фотографіями та рекламними матеріалами, де навіть невелика зміна обличчя або пропорцій може зіпсувати результат.
Редагування стало стабільнішим
Ще одна важлива зміна стосується роботи з кількома послідовними правками.
Раніше під час довгого ланцюжка редагувань генеративні моделі могли поступово змінювати деталі, які користувач не просив чіпати. У Images 2.5 OpenAI намагається вирішити цю проблему.
Тепер кожна наступна правка повинна краще враховувати попередні зміни. Наприклад, якщо спочатку змінити фон, потім одяг персонажа, а після цього освітлення, модель має зберігати результати попередніх етапів, не погіршуючи якість зображення.
Генерація стала до 50% швидшою
OpenAI також попрацювала над швидкістю роботи.
За заявою компанії, затримка під час створення зображень була скорочена до 50% у порівнянні з Images 2.0. Це дозволяє швидше експериментувати з різними варіантами та вносити правки без тривалого очікування.
Покращення стосуються не лише швидкості. Images 2.5 також генерує більш природне освітлення та деталізованіші текстури.
Новий інструмент Sketch
Одним із найбільш цікавих нововведень у ChatGPT став Sketch.
Тепер користувач може не тільки описати майбутнє зображення словами, а й буквально намалювати свою ідею безпосередньо в ChatGPT.
Наприклад, можна приблизно позначити:
- план кімнати;
- форму майбутнього одягу;
- розташування предметів;
- композицію кадру;
- персонажа або об’єкт.
Після цього ChatGPT використовує малюнок як візуальну підказку та створює повноцінне зображення. Для запуску функції достатньо ввести @Sketch у ChatGPT.
При цьому від користувача не вимагається вміння професійно малювати — ескіз може бути максимально простим.
Шаблони замість складних промптів
OpenAI також додала шаблони для популярних форматів контенту.
Замість того щоб починати з порожнього поля та самостійно формувати складний промпт, користувач може вибрати потрібний тип проєкту — наприклад, постер або мерч — а потім вказати необхідні елементи, текст, стиль та інші параметри.
Це має спростити створення рекламних матеріалів, постерів, зображень товарів та іншого візуального контенту.
Зображення тепер можна поширювати разом із промптом
Ще одне нововведення стосується обміну готовими результатами.
Під час поширення зображення користувач може передати не тільки сам результат, а й промпт, за допомогою якого його було створено.
Інша людина зможе використати цю ідею зі своїми фотографіями та власними деталями, отримавши персоналізовану версію зображення.
Нові моделі для розробників
Разом із ChatGPT Images 2.5 OpenAI представила дві нові моделі для API:
GPT-Image-2.5 Flare
Flare орієнтована на більшість практичних сценаріїв. Вона поєднує покращену якість, редагування та швидкість і, за словами OpenAI, забезпечує вищу якість зображень, ніж GPT-Image-2, при приблизно на 50% меншій затримці.
Модель розрахована на широкий спектр завдань — від створення контенту для соцмереж та продуктів до візуального пошуку, прототипування та масової генерації зображень.
GPT-Image-2.5 Sunburst
Sunburst призначена для більш вимогливих творчих процесів, де важливі максимальний контроль та точність під час редагування.
OpenAI позиціонує її для професійних сценаріїв, зокрема створення рекламних кампаній і якісних зображень продукції. При цьому генерація може займати більше часу.
Images 2.5 краще працює зі складними композиціями
Окремо OpenAI відзначає покращення в розумінні складних візуальних інструкцій.
Модель стала краще працювати з реалістичними об’єктами, складними макетами та прозорим фоном. Також покращилося відтворення заданих художніх стилів.
Для компаній це може бути особливо корисно під час створення серійного контенту, коли десятки або сотні зображень повинні дотримуватися одного візуального стилю та брендбуку.
OpenAI не відмовилася від захисту
Разом із новими можливостями компанія продовжує використовувати механізми безпеки для генерації зображень.
OpenAI зазначає, що ChatGPT Images 2.5 використовує перевірки промптів і зображень для запобігання шкідливому контенту. Крім того, для створених матеріалів застосовуються метадані C2PA та невидиме водяне маркування, які допомагають визначати походження зображень.
Де доступний ChatGPT Images 2.5
OpenAI повідомила, що Images 2.5 починає розгортатися для користувачів ChatGPT, ChatGPT Work і Codex на комп’ютерах, смартфонах та у вебверсії.
Для розробників доступні моделі GPT-Image-2.5 Flare та GPT-Image-2.5 Sunburst через API.
ChatGPT Images 2.5 виглядає не просто як чергове оновлення генератора зображень. OpenAI намагається перетворити його на повноцінний інструмент для роботи з графікою, де користувач може комбінувати текстові інструкції, власні фотографії, ескізи та послідовне редагування.
Найбільш помітними змінами стали точніше редагування, стабільність під час багатокрокових правок, покращена якість деталей і швидша генерація. А поява Sketch і шаблонів може зробити створення зображень доступнішим навіть для користувачів, які не вміють формулювати складні промпти.

