ChatGPT покращив генератор зображень: Images 2.5 пропонує детальніше редагування та функцію Sketch

OpenAI представила нову модель генерації зображень — ChatGPT Images 2.5. Компанія наголосила на чіткіших деталях, швидшій генерації та значно точнішому редагуванні порівняно з попередньою версією.

ChatGPT покращив генератор зображень: Images 2.5 пропонує детальніше редагування та функцію Sketch 3

Реліз відбувся через п’ять місяців після квітневого запуску ChatGPT Images 2. Тоді OpenAI додала підтримку роздільної здатності 2K, кілька варіантів співвідношення сторін, можливість використовувати веб-пошук для актуальної інформації, а також покращену роботу з мовами, що не використовують латиницю, і два рівні «інтелекту» — Instant та Thinking.

За словами OpenAI, щотижня користувачі створюють понад 3 мільярди зображень у ChatGPT Images та за допомогою моделей GPT-Image через API.

Що нового в Images 2.5

Нова модель, як стверджує компанія, забезпечує природніше освітлення, багатші текстури і краще зберігає риси людей та об’єктів із референсних фотографій. Крім того, вона стабільніше виконує інструкції з редагування навіть протягом кількох послідовних правок в одній розмові.

ChatGPT покращив генератор зображень: Images 2.5 пропонує детальніше редагування та функцію Sketch 4

Окрема увага приділена швидкості: затримку генерації зображень скорочено до 50% порівняно з Images 2.0, що дозволяє швидше створювати й допрацьовувати варіанти зображень.

Серед ключових напрямів покращення:

  • Точність у роботі з референсними фото — модель краще переносить впізнавані риси людини чи об’єкта в нове оточення, стиль або композицію, зберігаючи природність освітлення й текстур.
  • Прицільне редагування — Images 2.5 змінює лише те, що просить користувач, залишаючи решту зображення без змін навіть у складних сценах із багатьма деталями.
  • Стабільність під час багатоетапного редагування — попередні правки не «розмиваються» під час нових ітерацій, а якість зображення не деградує з кожним наступним кроком.
  • Розуміння складних інструкцій — модель точніше відтворює складні композиції, включно з прозорим фоном, і достовірніше передає реальні факти на зображеннях, де це важливо (наприклад, інфографіка чи презентаційні слайди).

Sketch, шаблони та обмін промптами

Разом з новою моделлю в ChatGPT з’являється функція Sketch — можливість намалювати ескіз прямо в чаті й використати його як візуальний орієнтир для фінального зображення. Ідея в тому, щоб швидко накидати композицію кімнати, силует одягу чи просто жарт-малюнок, а ChatGPT перетворить це на завершене зображення з урахуванням описаного стилю. Активувати функцію можна, ввівши «@Sketch» у чаті.

Компанія також запускає готові шаблони для популярних форматів — наприклад, постерів чи мерчу, — щоб користувачам не доводилося починати з чистого аркуша. Ще одне нововведення — можливість залишати коментарі безпосередньо на зображенні для точковіших правок, а також ділитися не лише готовим зображенням, а й промптом, яким його було створено, щоб інші могли повторити ідею зі своїми фото та деталями.

ChatGPT Images 2.5 вже доступна всім користувачам ChatGPT, ChatGPT Work і Codex — на десктопі, мобільних пристроях і в браузері, на всіх тарифних планах.

Дві нові моделі для розробників в API

Паралельно OpenAI випустила дві версії моделі для розробників через API:

Модель Призначення
GPT-Image-2.5 Flare Базовий вибір для більшості застосунків: вища якість порівняно з GPT-Image-2 при на 50% нижчій затримці. Підходить для контенту в соцмережах, продуктових вітрин, візуального пошуку, швидкого прототипування та масової генерації.
GPT-Image-2.5 Sunburst Створена для преміальних робочих процесів, де потрібен точніший контроль над редагуванням — наприклад, готова рекламна кампанія чи професійна продуктова фотографія.

Партнери компанії вже поділилися першими враженнями від роботи з новими моделями. Представник Higgsfield AI відзначив, що модель добре розуміє, які елементи зображення не варто змінювати під час редагування, зберігаючи персонажа, композицію та візуальну ідентичність оригіналу. В Adobe повідомили про інтеграцію GPT-Image-2.5 у Firefly, а команда Manus заявила, що Flare генерує зображення у 2–4 рази швидше за GPT-Image-2, що особливо корисно завдяки покращеній генерації прозорого фону для брендових матеріалів, презентацій і вебсайтів.

Безпека та ціни

OpenAI зазначає, що модель побудована з урахуванням наявних механізмів безпеки — перевірки промптів і зображень для запобігання шкідливому контенту. Компанія продовжує використовувати метадані стандарту C2PA та невидимі водяні знаки для маркування згенерованих зображень.

Модель GPT-Image-2.5 Flare та Sunburst доступні в API з відповідними тарифами на генерацію.

Реліз ChatGPT Images 2.5 з’явився через тиждень після запуску GPT-6 Astra — попереднього великого оновлення від OpenAI.

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *