OpenAI on juuri julkaissut uuden version ChatGPT:n kuvageneraattorista, nimeltään ChatGPT Images 2.0. Tämä uusi malli pystyy luomaan useita kuvia yhdellä ainoalla kehotteella ja sisältää parannuksia erityisesti tekstin tuottamisessa kuvissa. Malli on saatavilla maailmanlaajuisesti ChatGPT:n ja Codexin käyttäjille, ja maksullisille tilaajille on tarjolla tehokkaampi versio.
Kun merkittävä tekoälyyritys julkaisee uuden kuvamallin, se voi herättää uudelleen kiinnostusta ja lisätä käyttöä, erityisesti jos sosiaalisen median käyttäjät omaksuvat sen osaksi meemikulttuuriaan. Aiemmin Google saavutti suurta suosiota kun käyttäjät alkoivat jakaa hyperrealistisia kuvamalleja itsestään verkossa. Samalla tavoin ChatGPT Images on herättänyt huomiota sosiaalisessa mediassa, kun käyttäjät ovat jakaneet tekoälyn luomia karikatyyrejä.
Uusi malli hyödyntää ChatGPT:n ”päättelykykyjä”, mikä tarkoittaa, että se voi hakea ajankohtaista tietoa verkosta ja luoda useampia kuvia yhdellä kehotteella. Mallilla on myös tuoreempi tietopiste, joka ulottuu joulukuuhun 2025 saakka. Tämä antaa mahdollisuuden tarkempiin ja yksityiskohtaisempiin ulostuloihin. Esimerkiksi, kun luotiin infografiikka San Franciscon sääennusteesta seuraavalle päivälle, malli tuotti kuvan, joka sisälsi tarkat säätilatiedot ja realistisia piirroksia tunnetuista maamerkeistä.
Käyttäjät voivat myös mukauttaa kuvasuhteita, jolloin malli voi tuottaa kuvia laajasta 3:1 koosta kapeaan 1:3 kokoon. Tämä tarkoittaa, että käyttäjät voivat asettaa kuvan koon osaksi tehtävää kehotetta.
Ensimmäiset käyttökokemukset uudesta mallista ovat olleet positiivisia, erityisesti tekstin tuottamisessa englanniksi. Aiemmin kuvat, jotka sisälsivät tekstiä, kärsivät usein vääristyneistä merkeistä tai ylimääräisistä kirjaimista. Nyt Images 2.0 tuottaa puhtaampia ja monimutkaisempia tulosteita. Google on myös keskittynyt parantamaan tekstin tuottamista kuvissa viimeisimmissä versioissaan.
Toisaalta, kun mallia testattiin muilla kielillä, kuten kiinalla, tulokset eivät olleet yhtä onnistuneita. Kun kehotettiin luomaan Timothée Chalamet-aiheinen juliste kiinalaisen fanin näkökulmasta, tuloksena oli monimutkainen ja yksityiskohtainen kollaasi. Vaikka kuvat itsessään olivat laadukkaita, tekstit sisälsivät osittain virheellistä tai epäjohdonmukaista sisältöä, joka ei kääntynyt sujuvasti kiinaksi.
Vaikka uusi ChatGPT Images -malli suoriutuu hyvin tekstin tuottamisessa englanniksi, on epäselvää, saavatko käyttäjät ympäri maailman samanlaisia tuloksia omilla kielillään. OpenAI:n parannuksilla englanninkielisten kuvien osalta on mahdollista, että tulevissa versioissa nähdään lisää kehitystä myös muiden kielten osalta.
OpenAI:n uusin julkaisu osoittaa jälleen tekoälyn nopean kehityksen kuvien ja tekstin tuottamisessa. Yhtiön jatkuvat ponnistelut parantavat käyttäjäkokemusta ja tarjoavat uusia mahdollisuuksia luovaan sisällöntuotantoon. Samalla kun teknologia kehittyy, on mielenkiintoista nähdä, miten se vaikuttaa tulevaisuudessa esimerkiksi viestintään ja digitaaliseen kulttuuriin.