OpenAI julkaisi ChatGPT Images 2.5:n, uuden kuvamallinsa, joka tuottaa tarkempaa jälkeä ja noudattaa muokkausohjeita aiempaa luotettavammin. Kuvan luonti nopeutui yhtiön mukaan jopa 50 prosenttia edeltäjään Images 2.0:aan verrattuna.

Kuvagenerointi on noussut yhdeksi ChatGPT:n käytetyimmistä toiminnoista. OpenAI:n oman ilmoituksen mukaan ChatGPT Images ja rajapinnan GPT-Image-mallit tuottavat yhdessä yli kolme miljardia kuvaa viikossa. Päivitys koskee siis kerralla hyvin suurta käyttäjäjoukkoa.

Referenssikuvat säilyttävät tunnistettavuutensa

Suurin muutos koskee sitä, miten malli käsittelee käyttäjän omia valokuvia. Images 2.5 siirtää tutun kohteen uuteen ympäristöön, tyyliin tai sommitelmaan aiempaa paremmin. Kasvot ja muut erottuvat piirteet säilyvät tunnistettavina.

Valaistus ja pinnat näyttävät luonnollisemmilta. Ihon ja kankaan tekstuurit erottuvat, eikä lopputulos liu'u yhtä helposti muovimaiseen yleisilmeeseen. Ero näkyy selvimmin muotokuvissa ja tuotekuvissa.

Muutos on merkityksellinen, koska juuri tyylimuunnos hukkasi aiemmin tunnistettavuuden helpoimmin. Valokuvasta piirrokseksi tai maalaukseksi siirtyminen muutti kasvot usein toiseksi henkilöksi. Nyt lähtökuvan piirteet kantavat pidemmälle.

Rajapintaa käyttäville tiimeille sama parannus tarkoittaa vakaampia työnkulkuja. Kun variaatiot pysyvät kiinni alkuperäisessä lähdekuvassa, sarjan kuvat sopivat paremmin yhteen. Se on käytännön vaatimus esimerkiksi verkkokaupan kuvastoissa.

Muotokuva studionäytöllä, ihon ja kankaan tekstuuri tarkkana

Muokkaus rajautuu pyydettyyn kohtaan

Aiempien kuvamallien tunnettu ongelma on ollut se, että yhden yksityiskohdan korjaus muuttaa koko kuvan. Images 2.5 muokkaa vain sitä, mitä käyttäjä pyytää, ja jättää muun ennalleen. Ero korostuu monimutkaisissa kohteissa ja taustoissa.

Malli pitää kiinni myös aiemmista muokkauksista. Pitkässä keskustelussa jokainen uusi korjaus rakentuu edellisten päälle sen sijaan, että kuvanlaatu rapautuisi kierros kierrokselta. Tämä oli aiemmin yleinen syy aloittaa koko kuva alusta.

Kehittäjille tämä avaa kohdennetut päivitykset. Yksittäinen tuote, tausta tai tekstielementti voidaan vaihtaa ilman, että sommitelma tai brändin ilme muuttuu ympäriltä. Koko kuvaa ei tarvitse rakentaa uudelleen.

Rajaus vaikuttaa myös siihen, montako kierrosta valmis kuva vaatii. Kun jokainen korjaus osuu kohdalleen, turhat välivaiheet jäävät pois. Se näkyy suoraan sekä ajankäytössä että rajapinnan kustannuksissa.

Valintamaski hehkuu yhden kohteen ympärillä kuvankäsittelynäytöllä

Sketch ja valmiit pohjat ohjaavat lopputulosta

ChatGPT sai samalla kaksi uutta ohjaustapaa. Sketch antaa piirtää suoraan sovelluksessa, ja piirros toimii lopullisen kuvan visuaalisena runkona. Toiminto avautuu kirjoittamalla keskusteluun @Sketch.

Luonnoksen ei tarvitse olla taidokas. Huoneen karkea pohjapiirros tai vaatteen ääriviiva riittää kertomaan sommitelman, jonka malli täyttää annetun tyylikuvauksen mukaan. Sanallinen kuvaus jää tarkentamaan yksityiskohdat.

Pohjat puolestaan korvaavat tyhjän aloituksen. Käyttäjä valitsee formaatin, kuten julisteen tai tuotekuvan, ja täydentää siihen omat tietonsa ja tyylitoiveensa. Yleisimmät kuvaformaatit eivät siis vaadi kehotteen kirjoittamista nollasta.

Kommentointi ja kehotteiden jakaminen siirtävät kuvantekoa yhteiseen suuntaan. Kollega voi merkitä korjattavan kohdan suoraan kuvaan sen sijaan, että kuvailisi sitä sanoin. Jaettu kehote taas antaa toisen kokeilla samaa ideaa omilla kuvillaan.

Käsi piirtää luonnosta tabletille valmiiden pohjien vieressä

Kehittäjille kaksi uutta rajapintamallia

Rajapintaan tuli kaksi mallia samasta perheestä. GPT-Image-2.5 Flare tuo samat parannukset laatuun, muokkaukseen ja nopeuteen kuin ChatGPT-versio. GPT-Image-2.5 Sunburst tähtää tarkempaan jälkeen ja käyttää siihen enemmän aikaa.

Jako on käytännöllinen. Nopea malli sopii iteratiiviseen konseptointiin ja suuriin eriin, hitaampi viimeisteltyihin lopputuloksiin. Valinta tehdään tehtävän eikä yhden yleismallin ehdoilla.

Molemmat ymmärtävät aiempaa monimutkaisempia visuaalisia ohjeita. Malli käsittelee vaativammat asettelut ja läpinäkyvät taustat sekä pitää kiinni pyydetystä tyylistä, kun ohjeet tarkentuvat. Se on edellytys sille, että sarja brändinmukaisia kuvia pysyy yhtenäisenä.

ChatGPT-puolella Images 2.5 on jo saatavilla kaikille ChatGPT-, ChatGPT Work- ja Codex-käyttäjille työpöydällä, mobiilissa ja selaimessa. Erillistä käyttöönottoa ei tarvita.

Kaksi rinnakkaista kuvageneraatioajoa kehittäjän konsolissa

Yhteenveto

Images 2.5 ei tuo uutta kykyä vaan tarkentaa vanhoja. Nopeus, referenssikuvien tunnistettavuus ja rajattu muokkaus korjaavat juuri niitä kohtia, joihin aiemmat mallit kompastuivat tuotantokäytössä.

Käytännön merkitys ratkeaa arjessa. Jos monivaiheinen muokkaus todella pitää laadun kierroksesta toiseen, kuvageneroinnista tulee työkalu myös niille tiimeille, jotka ovat tähän asti palanneet perinteiseen kuvankäsittelyyn viimeistelyvaiheessa.