Óriási frizurák, farmerdzsekik, fakó színek és olyan portrék, mintha negyven éve kerültek volna elő a családi albumból. Az elmúlt napok egyik látványos közösségimédia-trendje mögött a ChatGPT képgenerátora áll, elmagyarázzuk, hogyan.

Ha az elmúlt napokban az Instagramot vagy a TikTokot pörgetted, szinte biztosan szembejött egy olyan kép, ami megszólalásig hasonlít egy 1980-as évekbeli polaroid fotóra. Hatalmasra tupírozott hajak, neon és farmerdzsekik, analóg filmzaj és az a jellegzetes, meleg vintage színvilág. Ez valójában egy MI- és közösségi trend, ezeket a képeket a ChatGPT legújabb képgeneráló funkciói hozzák létre mindössze pár másodperc alatt.
Nem ez az első alkalom, hogy a közösségi médiát elárasztják a mesterséges intelligencia által generált képmódosító őrületek. Korábban már láthattunk hasonló hullámokat: emlékezzünk csak a FaceApp öregítő szűrőire, vagy a középkori portrékat és anime karaktereket formázó applikációkra, a rajzfilmes portrékat vagy játékfigurának kinéző változatokat generáló ChatGPT-trendekre, amelyek rendre felrobbantották a netet.
ChatGPT: Az amerikai OpenAI által 2022 novemberében elindított, nagy nyelvi modellre (LLM) épülő mesterségesintelligencia-szolgáltatás. A platform felhasználói bázisa példátlan sebességgel növekedett: az alkalmazás aktív havonta használt felhasználóinak száma meghaladja az 1 milliárd főt, a heti aktív felhasználók száma pedig eléri a 900 milliót. A szolgáltatás nemcsak szöveges válaszadásra és elemzésre, hanem közvetlen képgenerálásra és -módosításra is alkalmas.
Generatív mesterséges intelligencia: A mesterséges intelligencia olyan ága, amely nem meglévő adatok osztályozásával vagy keresésével foglalkozik, hanem gépi tanulási és mélytanulási modellek segítségével teljesen új, eredeti tartalmakat - szöveget, képet, programkódot, hangot vagy videót - hoz létre a betáplált mintázatok alapján.
A technológiai folyamat meglepően egyszerű, és éppen ebben rejlik a népszerűsége. A felhasználók néhány lépésben alakítják át a mindennapi portréikat retró polaroid fotókká:
A prompt az az utasítás, amelyet a mesterséges intelligenciának adunk. Nem kell hozzá programozni: egy olyan hétköznapi mondat is prompt, mint hogy „készíts ebből a képből egy 1980-as években készült családi fotót”.
Egy jó eredmény adó magyar nyelvű utasítás például ilyen lehet:
„Alakítsd át ezt a fotót úgy, mintha 1986-ban készült volna. Az arcom és a felismerhető vonásaim maradjanak meg, de a frizurát, ruhát és környezetet alakítsd át hiteles 80-as évekbeli stílusra. A kép nézzen ki valódi, korabeli analóg fényképnek enyhe filmszemcsével, természetes bőrtónussal és kissé fakó színekkel.”
Minél konkrétabban fogalmazunk, annál jobban meghatározhatjuk a végeredményt. Kérhetünk például nyolcvanas évekbeli családi fotót, iskolai évkönyvportrét, diszkót, magazinfotót vagy egyszerű hétköznapi pillanatképet. A ruházat, a háttér, a fény és akár a kép képaránya is megadható.
Ha elsőre nem tetszik az eredmény, nem kell újrakezdeni. Ugyanabban a beszélgetésben kérhetjük például, hogy legyen kevésbé feltűnő a frizura, maradjon pontosabb az arc, változzon meg a háttér vagy tűnjenek el a képről a modern tárgyak. A ChatGPT képszerkesztője további módosításokra is használható.
Lamentálhatnánk persze az AI-slop (a mesterséges intelligencia által termelt tömeges hulladék-tartalom) és a közösségi média trendek céltalansága felett, ezek mégis sok embert (akár a gyerekünket is) lázba hoznak, nem biztos, hogy ennek értékét kell folyton méregetnünk.
Sokkal fontosabb az adatvédelmi tudatosság kérdése. A feltöltött fénykép pontosan ugyanúgy felhasználói tartalomnak minősül, mint a ChatGPT-nek begépelt szövegek. Az OpenAI adatvédelmi tájékoztatója külön nevesíti a képeket: egy portré tehát nem csupán átszalad egy ártalmatlan szűrőn, hanem nyers adatként bekerül abba az infrastruktúrába, amely az új fotót előállítja.
Ezért kezeljük úgy a feltöltött képeket, mintha nyilvános felületre tennénk ki.
Gyerekek esetében érdemes még szigorúbban meghúzni a határokat, ha a játékhoz elegendő egy semleges portré, felesleges személyesebb családi felvételeket kockáztatni. Ha egy érzékenyebb fotó mégis felkerülne a kísérletezés közben, és azt el szeretnénk távolítani a fiókból, érdemes a Könyvtár menüpontot ellenőrizni, és ott manuálisan törölni a fájlt.
Aki csupán egyetlen alkalommal szeretné elkészíteni a nyolcvanas évekbeli portréját, és nincs szüksége a beszélgetés későbbi megőrzésére, a legbölcsebben teszi, ha az Ideiglenes csevegés menüpontot választja. Ezek a párbeszédek nem jelennek meg az előzmények között, nem hoznak létre memóriát, nem képezik a modellek tanítási alapját, és az OpenAI tájékoztatása szerint legfeljebb 30 napon belül véglegesen törlődnek a rendszerekből. Az itt feltöltött fájlok elvileg nem kerülnek be a fiók Könyvtárába. Ha tehát valaki kifejezetten egyetlen MI-kísérlet kedvéért tölt fel egy portrét, az adatminimalizálás szempontjából ez lényegesen tisztább és biztonságosabb út, mint egy éveken át őrzött, normál beszélgetés.