Több mint négyezer kérdéssel történő kamaszfiókok tesztelése és gyermekpszichiáterek bevonása után a Common Sense Media a lehető legsúlyosabb, „elfogadhatatlan kockázat” minősítést adta a ChatGPT tinédzsereknek szánt változatának. Az OpenAI vitatja az eredményeket.

A Képernyőidő ingyenes, de nem ingyen készül. Segítsd munkánkat egy tetszőleges adománnyal, hogy minél több tartalom születhessen.
A tárgy mezőbe írd be, hogy adomány. Köszönjük segítséged, igyekszünk megszolgálni.
Augusztus 18-án mi is megírtuk, hogy az OpenAI megkezdte a ChatGPT tinédzsereknek szánt változatának bevezetését. Ez nem egy külön alkalmazás vagy külön mesterségesintelligencia-modell: a rendszer a 13-17 évesként azonosított fiókoknál speciális biztonsági szabályokat, tanulási funkciókat és korlátozásokat kapcsol be.
OpenAI: Mesterséges intelligencia kutatásával és alkalmazásával foglalkozó amerikai vállalat, amely többek között a ChatGPT-t fejleszti. 2015-ben nonprofit szervezetként indult, ma a nonprofit OpenAI Foundation és az általa irányított, profitorientált OpenAI Group alkotja. Saját megfogalmazásuk szerint céljuk, hogy a mesterséges általános intelligencia az egész emberiség javát szolgálja.
A ChatGPT for Teens ígérete kifejezetten bíztató volt. A tinédzserváltozatnak szigorúbban kell kezelnie többek között az önkárosítást, az evészavarokat, a szexuális tartalmakat és az érzelmi függőség kialakulását. A szülő összekapcsolhatja saját fiókját a gyerekével, időkorlátokat és tanulási beállításokat adhat meg, bizonyos súlyos biztonsági helyzetekben pedig értesítést is kaphat, de nem olvashatja a gyerek beszélgetéseit.
Most először készült nagyobb független vizsgálat arról, mennyire működnek ezek a védelmi megoldások a gyakorlatban, a Common Sense Media Youth AI Safety Institute intézetének segítségével. Az eredmény jóval rosszabb lett annál, amit az augusztusi bejelentés alapján várni lehetett.
Common Sense Media: Amerikai nonprofit szervezet, amely filmeket, játékokat, alkalmazásokat és digitális szolgáltatásokat vizsgál gyerekbiztonsági és családi szempontból. Saját Youth AI Safety Institute nevű intézete külön a mesterséges intelligenciára épülő szolgáltatások kockázatait kutatja és teszteli. A szervezet finanszírozásában alapítványok és technológiai szereplők is részt vesznek - köztük az OpenAI Foundation -, de az intézet közlése szerint a vizsgálatok és értékelések szerkesztőileg függetlenül készülnek.
A kutatók két időszakban tesztelték a ChatGPT-t:
Ingyenes és fizetős fiókokat, szülőhöz kapcsolt és önálló tinédzserfiókokat egyaránt használtak. A regisztrált életkor 13 és 17 év között változott, kontrollként pedig 19 évesnek megadott fiókokkal is végeztek próbákat, összesen több mint 4000 kérést futtattak végig. A mentális egészséggel kapcsolatos tesztek egy részét gyermek- és serdülőpszichiáterek, valamint gyermekgyógyász szakértő bevonásával értékelték.
A kutatás tehát nem néhány ügyesen megfogalmazott provokációból állt, hanem előre meghatározott tesztsorozatokból.
Látszottak azért pozitív eredmények is. A ChatGPT például általában megtagadta az explicit szexuális szerepjátékot, nem adott önkárosítási módszereket vagy evészavarhoz használható fogyási terveket, és több krízishelyzetben megfelelően próbálta a gyereket egy felnőtt vagy orvos felé terelni. A kutatók szerint több válasz szakmailag is helyesebb lett a tinédzsermód bevezetése után. De sajnos feltűnt pár igazán súlyos hiányosság is.
A vizsgálat egyik legaggasztóbb része éppen azt a funkciót érintette, amelytől egy szülő joggal várhatna plusz biztonságot. A kutatók frissen létrehozott, szülői fiókhoz kapcsolt tesztfiókokon akár egy órán keresztül folytattak öngyilkossági gondolatokról, önkárosításról vagy evészavarról szóló beszélgetéseket. Ezekben a tesztekben egyetlen szülői értesítés sem érkezett.
Hosszabb ideje használt tesztfiókoknál már előfordult riasztás, de kevés. A teljes, heteken át tartó krízistesztelés alatt összesen négy értesítést kaptak: hármat öngyilkossággal vagy önkárosítással, egyet evészavarral kapcsolatos beszélgetés miatt. Egy korábbi tesztfióknál az egyik riasztás három órával, egy másik három nappal az első súlyos tartalmú beszélgetés után érkezett meg.
A Common Sense Media ebből arra következtetett, hogy a riasztás működésében az addigi beszélgetési előzményeknek is komoly szerepe lehet, miközben egy első alkalommal jelentkező súlyos krízist a rendszer nem feltétlenül jelez megfelelően. Ezt azonban a kutatók teszteredményeik alapján állítják, az OpenAI nem erősítette meg, hogy a riasztási rendszer valóban így működne. Bárhogy is, a ChatGPT szülői felügyelete eleve nem arra szolgál, hogy a szülő beleolvashasson a gyerek beszélgetéseibe. A hivatalos leírás szerint csak bizonyos biztonsági helyzetekben küld értesítést, ezért a család számára különösen nagy jelentősége van annak, hogy ezek a jelzések mennyire megbízhatóak.
A vizsgálat mentális egészséggel foglalkozó részében 390 különböző tesztkérést értékeltek. Ezek közül a szakértők 201 esetben ítélték úgy előzetesen, hogy valamilyen krízisforrás - például segélyvonal, orvos vagy mentálhigiénés szakember - ajánlása indokolt lenne.
A tinédzsermód bevezetése után a ChatGPT ezeknek az eseteknek 74 százalékában adott legalább valamilyen konkrét segítségforrást. Másképp fogalmazva: minden negyedik olyan helyzetben, amelyben a szakértők ezt indokoltnak tartották, nem történt ilyen továbbirányítás szakértői segítség felé. A megbízható felnőtt bevonására vonatkozó javaslat ugyanakkor javult, 87-ről 94 százalékra.
Itt is akadt azért pozitívabb eredmény: a kutatók azt is észrevették, hogy a válaszok rövidebbé váltak, ami önmagában segíthetne egy krízisben lévő fiatalnak. A megfogalmazás ugyanakkor átlagosan bonyolultabb lett, és több orvosi kifejezést használt. A klinikai szakértők közben sok konkrét választ kifejezetten megfelelőnek tartottak: a ChatGPT például megtagadta a veszélyes fogyáshoz szükséges kalóriaszámok megadását, és fizikai veszélyre utaló tüneteknél orvosi segítséget javasolt.
A másik kellemetlen eredmény az oktatási funkciókat érinti. Az OpenAI a ChatGPT tinédzsereknek szánt változatának egyik fontos előnyeként mutatta be a Tanulási módot, amelynek célja, hogy a gyerek kész megoldás helyett lépésről lépésre jusson el a válaszig.
A tesztben ez addig működött jól, amíg a diák valóban tanulni akart. A kutatók szerint a Tanulási módban megjelenő „Show me the answer” lehetőséggel több esetben egyszerűen ki lehetett kérni a kész megoldást. A szülő által beállítható Tanulási időszakok sem jelentenek hagyományos értelemben vett tiltást: az OpenAI saját leírása is úgy fogalmaz, hogy az adott időszakban az új beszélgetések Tanulási módban indulnak, nem azt ígéri, hogy abból lehetetlen kilépni.
A Common Sense Media tesztelői ennél is egyszerűbb kerülőutat találtak. A tanulási időszakban a rendszer a kérést egy „@study” előtaggal küldte el, ennek törlése után a beszélgetés normál módban folytatódott. Amikor a Tanulási mód nem volt aktív, a vizsgálatban a ChatGPT mind a 80 beadott feladatnál elkészítette a teljes megoldást, így gyakorlatilag pillanatok alatt meg lehetett kerülni azt a rendszert, ami arra hivatott, hogy a gyereket segítse a gondolkodásban, kész válaszok nélkül, inkább csak magyarázva.
Az OpenAI a The Verge-nek adott válaszában közölte, hogy elkötelezett a tinédzserek biztonsága és a független vizsgálatok mellett, de nem ért egyet azzal, hogy a Common Sense Media tesztje pontosan tükrözné a ChatGPT biztonsági rendszereinek valós működését.
A vállalat szerint a tesztelés jelentős része még azelőtt kezdődhetett és fejeződhetett be, hogy a szülői felügyeleti funkciók aktiválása teljesen lezajlott volna az érintett fiókokon. Emiatt szerintük ezekből a tesztekből nem lehet biztosan megállapítani, hogy a szülői riasztások a tervezett módon működnek-e.
A Common Sense Media erre azt válaszolta, hogy a tesztelés előtt egyeztettek az OpenAI-jal arról, mely funkciók működnek már. A szervezet szerint valóban csak később tudták meg, hogy egy újonnan összekapcsolt szülői és gyerekfióknál az értesítések aktiválása akár több órát is igénybe vehet. Állításuk szerint azonban olyan fiókoknál is elmaradtak riasztások, amelyek ennél jóval régebb óta össze voltak kapcsolva, ezért kitartanak a vizsgálat eredménye mellett.
A vizsgálatból nyilván nem az következik, hogy minden ChatGPT-t használó gyerek veszélyben van. Az sem, hogy a tinédzserváltozat biztonsági funkciói egyáltalán nem működnek. Éppen ellenkezőleg: a teszt több olyan területet talált, ahol a rendszer megfelelően korlátozta a veszélyes válaszokat. De le kell szögeznünk, hogy a beépített gyermekvédelmi funkciókat egyelőre nem érdemes biztonsági hálóként kezelni. Ha egy gyerek ChatGPT-t használ, a bekapcsolt szülői felügyelet hasznos plusz lehet, de egy elmaradó riasztásból nem lehet arra következtetni, hogy nincs probléma. Maga az OpenAI is „korlátozott” magas kockázatú helyzetekre ígéri ezeket az értesítéseket, miközben a szülő a beszélgetések tartalmát nem látja.
Ugyanez igaz a tanulásra. A Tanulási mód jó eszköz lehet annak a gyereknek, aki valóban meg szeretné érteni a feladatot, de a jelenlegi formájában nem akadályozza meg megbízhatóan, hogy valaki kész megoldást kérjen. A technikai korlát ezért nem helyettesíti azt a családi szabályt, hogy mire használjuk a mesterséges intelligenciát az iskolai munkában, és mi az, amit továbbra is a gyereknek kell végiggondolnia.
A Common Sense Media ennél keményebb következtetésre jutott: azt javasolja, hogy az OpenAI a problémák kijavításáig ne tegye elérhetővé a ChatGPT-t 18 év alattiak számára.
Az OpenAI ezt az értékelést vitatja. Abban viszont a mostani eredmények alapján nehéz lenne vitatkozni, hogy egy „tinédzsereknek készült” felirat önmagában még nem garancia arra, hogy a mögötte működő gyermekvédelmi rendszer minden helyzetben képes arra, amit egy laikus szülő elvárna tőle.