Az OpenAI 2026. szeptember 8-án mutatta be a ChatGPT Images 2.5-öt, amely nem egyszerűen szebb képek előállítását ígéri. Az új generáció egyik legfontosabb előrelépése a képek utólagos módosításában, a referenciafotók követésében és a több lépésből álló szerkesztési folyamatokban keresendő. Mindehhez akár 50 százalékkal gyorsabb generálás, természetesebb fények és textúrák, valamint új kreatív eszközök társulnak.
Új szintre lépett a ChatGPT képgenerálása
A generatív mesterséges intelligencia egyik leggyorsabban fejlődő területe a képalkotás. Míg néhány évvel ezelőtt már az is lenyűgözőnek számított, ha egy AI néhány mondatból felismerhető, viszonylag koherens képet tudott készíteni, ma már egészen mások az elvárások.
A felhasználók egyre gyakrabban valódi munkaeszközként tekintenek a képgenerátorokra. Termékfotókat, reklámanyagokat, weboldalak illusztrációit, közösségi médiás kreatívokat, prezentációkat, infografikákat vagy éppen fotórealisztikus illusztrációkat készítenek velük.
Az OpenAI szerint hetente már több mint 3 milliárd kép készül a ChatGPT Images és az API-ban elérhető GPT-Image modellek segítségével. A ChatGPT Images 2.5 ennek megfelelően már sokkal inkább komplett kreatív eszközként próbál működni, mint egyszerű szöveg-kép generátorként. (OpenAI)
Akár 50 százalékkal gyorsabb lehet
Az egyik legkönnyebben észrevehető változás a sebesség.
Az OpenAI közlése szerint az Images 2.5 esetében a képgenerálás késleltetését akár 50 százalékkal sikerült csökkenteni az Images 2.0-hoz képest. Ez különösen akkor számít sokat, amikor nem egyetlen képet szeretnénk elkészíteni, hanem folyamatosan finomítjuk az eredményt.
Egy professzionális munkafolyamat ugyanis gyakran nem abból áll, hogy megadunk egy promptot, majd elfogadjuk az első eredményt. Sokkal inkább úgy néz ki, hogy elkészül az első változat, majd megváltoztatjuk a hátteret, módosítjuk a fényeket, áthelyezünk egy tárgyat, javítjuk a feliratot vagy új ruhát adunk a szereplőre.
Minél gyorsabban történnek meg ezek a módosítások, annál közelebb kerül a generatív AI használata egy hagyományos grafikai program interaktivitásához.
Sokkal fontosabb azonban, hogy mit nem változtat meg
A generatív képszerkesztés egyik régi problémája, hogy egy apró módosítás során a rendszer hajlamos volt olyan részleteket is megváltoztatni, amelyekhez a felhasználó egyáltalán nem akart hozzányúlni.
Például arra kérjük az AI-t, hogy egy autó mögött változtassa meg a hátteret, de közben az autó felnije, lámpája vagy akár karosszériájának formája is megváltozik. Egy portrénál pedig egy ruhadarab módosítása után az arc is eltérhet az eredetitől.
Az Images 2.5 egyik kulcsfontosságú fejlesztése éppen ennek csökkentése.
Az OpenAI szerint az új modell pontosabban képes csak a megjelölt elemet módosítani, miközben a kép többi részét változatlanul hagyja. Ez összetett háttereknél és több szereplőt tartalmazó kompozícióknál is működőképesebb lett. (OpenAI)
A referenciafotókat is jobban követi
Szintén komoly előrelépés történt akkor, amikor már meglévő fotóból indulunk ki.
A ChatGPT Images 2.5 az OpenAI szerint jobban megőrzi a referenciafotón szereplő személyek és objektumok jellegzetességeit. Egy embernek például nagyobb eséllyel marad felismerhető az arca akkor is, ha más környezetbe vagy teljesen eltérő vizuális stílusba helyezzük.
A modell természetesebb megvilágítást és részletesebb textúrákat is képes előállítani.
Ez különösen fontos lehet portrék, termékfotók és olyan kreatív anyagok készítésénél, amelyeknél ugyanannak a szereplőnek vagy tárgynak több különböző változatban is következetesen kell megjelennie. (OpenAI)
Több szerkesztés után sem kell szétesnie a képnek
A korábbi generatív képszerkesztők másik tipikus gyengesége az úgynevezett többlépéses szerkesztés volt.
Az első változtatás még jól sikerült, majd jött a második, harmadik, negyedik módosítás, és közben az eredeti kép egyre több részlete kezdett megváltozni.
A ChatGPT Images 2.5 esetében az OpenAI kifejezetten dolgozott a multi-turn editing consistency, vagyis a több körön keresztül végzett szerkesztések következetességének javításán.
Az előző módosításoknak nagyobb eséllyel kell megmaradniuk, miközben a modell az újabb instrukciókat is végrehajtja. Ez már jóval inkább hasonlít egy valódi kreatív munkafolyamathoz, ahol a felhasználó fokozatosan építi fel a végleges képet. (OpenAI)
Rajzolhatunk is a ChatGPT-nek
Az Images 2.5 bevezetésével a ChatGPT képkészítő felülete is fejlődött.
Az egyik érdekes újdonság a Sketch, amelynek segítségével a felhasználó lerajzolhatja, hogy nagyjából milyen kompozíciót szeretne.
Ez azért lehet hasznos, mert bizonyos vizuális elképzeléseket meglepően nehéz szövegben pontosan megfogalmazni. Sokkal egyszerűbb lehet például néhány vonallal jelezni, hogy hol legyen az ember, az autó, az épület vagy a címfelirat, majd megkérni az AI-t, hogy ebből készítsen professzionális képet.
A ChatGPT a vázlatot vizuális referenciaként használhatja a végleges kép elkészítéséhez. (OpenAI)
Megérkeztek a sablonok is
Az OpenAI egy másik irányból is egyszerűsíti a képkészítést.
Az Images 2.5 köré épülő rendszerben Templates, vagyis sablonok is megjelentek. Ezekkel például plakátok, termékfotók, merchandise-anyagok és más gyakori vizuális formátumok készítése indítható el anélkül, hogy mindent nulláról kellene megfogalmazni.
A felhasználó kiválaszthat egy megfelelő kiindulási formátumot, majd megadhatja a tartalmat, stílust és további részleteket.
Ez elsősorban azok számára lehet érdekes, akik nem feltétlenül akarnak hosszú, rendkívül részletes promptokat írni minden egyes kép elkészítéséhez. (OpenAI Help Center)
Kommenttel is megmondhatjuk, mit kell átírni
Az új rendszer egyre közelebb kerül ahhoz, mintha egy grafikussal dolgoznánk együtt.
A képekhez megjegyzéseket lehet fűzni, így célzottabban jelezhető, hogy pontosan melyik területen szeretnénk változtatást.
Ahelyett tehát, hogy egy hosszú promptban próbálnánk körülírni, melyik objektumot szeretnénk módosítani, közvetlenebb módon adhatunk szerkesztési utasításokat.
Mobilon egy elkészített képet teljes képernyőn megnyitva szerkesztési utasításokat és kommenteket is hozzáadhatunk. (OpenAI Help Center)
A bonyolultabb vizuális utasításokat is jobban érti
A fejlődés nem kizárólag a fotórealizmusra koncentrál.
Az Images 2.5 komplexebb vizuális utasításokat és elrendezéseket is pontosabban tud értelmezni. Az OpenAI külön kiemeli az infografikák pontosságát és elrendezését, valamint a transzparens hátterek kezelését. (OpenAI Deployment Safety Hub)
Ez azért fontos, mert a modern AI-képgenerátorok felhasználási területe már messze túlmutat a látványos fantasy képek vagy portrék készítésén.
Egyre fontosabbak a reklámgrafikák, prezentációs elemek, webes vizuális komponensek és egyéb, pontos elrendezést igénylő tartalmak.
Két változat érkezett a fejlesztők számára
Az Images 2.5 nemcsak a ChatGPT-ben jelent meg. Az OpenAI az API-t használó fejlesztők számára két külön modellt vezetett be.
A GPT-Image-2.5 Flare az általános felhasználásra szánt változat. Az OpenAI ezt ajánlja alapértelmezett modellként a legtöbb alkalmazáshoz, például közösségi médiás tartalmakhoz, termékélményekhez, vizuális kereséshez, gyors prototípusokhoz és nagy mennyiségű képgeneráláshoz.
A vállalat szerint a Flare az előző GPT-Image-2 modellnél jobb képminőséget kínálhat, miközben a késleltetés körülbelül 50 százalékkal alacsonyabb.
A GPT-Image-2.5 Sunburst ezzel szemben a precízebb, prémium kreatív feladatokra készült. Lassabb lehet, viszont nagyobb kontrollt kínál olyan munkáknál, mint a végleges kampányanyagok vagy igényes termékfotók készítése. (OpenAI)
Az AI-képek felismerhetőségére is figyel az OpenAI
A jobb fotórealizmus természetesen újabb kérdéseket vet fel azzal kapcsolatban, hogy miként lehet megkülönböztetni a mesterséges intelligenciával készített képeket a valódi fotóktól.
Az OpenAI ezért továbbra is alkalmazza a C2PA metaadatokat és láthatatlan vízjelezési technológiát, amelyek segíthetnek az AI-val létrehozott tartalmak eredetének azonosításában.
Az Images 2.5 biztonsági rendszere az Images 2.0 megoldásaira épül, kiegészítve az új képességekhez kapcsolódó további védelmi mechanizmusokkal. (OpenAI)
Kik használhatják a ChatGPT Images 2.5-öt?
Az OpenAI bejelentése szerint a ChatGPT Images 2.5 minden ChatGPT-csomagban elérhetővé válik, továbbá a ChatGPT Work és a Codex felhasználói is hozzáférhetnek asztali gépen, mobilon és weben.
A fejlesztők számára a Flare és Sunburst modellek az API-n keresztül érhetők el. (OpenAI)
A ChatGPT Images 2.5 hivatalos bemutatója az OpenAI oldalán
A következő nagy lépés nem feltétlenül a szebb kép
A ChatGPT Images 2.5 talán legérdekesebb üzenete, hogy az AI-képgenerátorok fejlődésének következő szakasza már nem kizárólag arról szól, hogy melyik modell tud látványosabb vagy fotórealisztikusabb képet előállítani.
Legalább ennyire fontos lett a kontrollálhatóság.
Egy professzionális kreatív eszköznek ugyanis nem elég egyszer jól eltalálnia a felhasználó elképzelését. Meg kell őriznie az előző változtatásokat, pontosan azt kell módosítania, amit kérünk tőle, és lehetőleg érintetlenül kell hagynia mindazt, amit nem szeretnénk megváltoztatni.
A ChatGPT Images 2.5 fejlesztései jelentős részben pontosan erre koncentrálnak. Ha pedig a generatív képalkotás ebben az irányban fejlődik tovább, az AI egyre kevésbé egyszerű „képgenerátor”, és egyre inkább interaktív kreatív munkaeszköz lehet.
