Kutatás: az ember akkor is nagyon magabiztos lesz, amikor a mesterséges intelligencia téved

Kísérlet is bizonyítja, hogy az MI-re támaszkodó emberek nagyon bíznak abban, hogy igazuk van, akkor is, amikor a gép téved. Ez pedig nem jó jel.

Kutatás: az ember akkor is nagyon magabiztos lesz, amikor a mesterséges intelligencia téved

Nincs most elég időd? 

  • Egy kb. háromezer fős, öt kísérletből álló nemzetközi kutatás azt vizsgálta, mi történik, ha az emberek nehéz kérdések megválaszolásához egy meggyőzően fogalmazó, de rendszeresen tévedő mesterséges intelligenciától kapnak segítséget.
  • Az MI-hez hozzáférő résztvevők több kérdésre feleltek, mégis csak harmadannyiszor találták el a helyes választ, mint a gépi tanács nélkül dolgozók.
  • Közben közel két és félszer biztosabbak lettek magukban, és szinte teljesen eltűnt az eszköztárukból a „nem tudom” válasz.
  • A hatás akkor is bivalyerős maradt, amikor az MI válasza kéretlenül, magától ugrott fel a képernyőn.
  • A szülői tanulság adja magát: a gyerek előbb próbáljon meg saját választ keresni és adni, és ellenőrizze a chatbot válaszát, mert a magabiztosan tévedő embertípus nem könnyíti meg a saját, de a környezete dolgát sem hosszú távon.

SEGÍTS, HOGY SEGÍTHESSÜNK!

A Képernyőidő ingyenes, de nem ingyen készül. Segítsd munkánkat egy tetszőleges adománnyal, hogy minél több tartalom születhessen.

  • Számlaszám: 12100011-19129370
  • Név: LogIn Digitális Edukáció Egyesület

A tárgy mezőbe írd be, hogy adomány. Köszönjük segítséged, igyekszünk megszolgálni.

Az MI egyik legvonzóbb – és egyben legveszélyesebb – tulajdonsága, hogy szinte mindig van válasza. Soha nem kér gondolkodási időt, nem vakarja a fejét zavarában, és nagyon ritkán hagyja üresen a képernyőt. Ráadásul a zseniális meglátás és a gigantikus tévedés pontosan ugyanolyan rendezett, választékos és határozott formában landol előttünk.

🧠 Miről is van szó pontosan?

MI (mesterséges intelligencia): Olyan számítógépes rendszerek gyűjtőneve, amelyek adatokból tanulva képesek például szöveget írni, képet készíteni, kérdésekre válaszolni, mintákat felismerni vagy döntési javaslatokat adni. Nem emberként gondolkodnak, hanem a tanult összefüggések alapján számítják ki, milyen válasz lehet a legvalószínűbb. Emiatt magabiztosan is közölhetnek pontatlan vagy teljesen kitalált információt.

A lehengerlően magabiztos hangnem önmagában persze az égvilágon semmit sem bizonyít, de az sem segít, hogy az online vitakultúra az utóbbi évek (évtizedek) során abba az irányba terelt mindenkit, hogy aki dogmatikusan állít hülyeséget, az is képes felépíteni a saját valóságát.

Egy friss kutatás pontosan erre a pszichológiai csapdára világított rá: mi történik velünk, ha bizonytalanok vagyunk, de a gép gondolkodás nélkül az arcunkba tol egy kész választ?

Papilonia Lepkevilág Papilonia Lepkevilág Hirdetés

A bizonytalanság nem gyengeség

A jó döntéshozatalnak van egy méltatlanul alulértékelt szuperképessége, amikor képesek vagyunk kimondani azt, hogy „nem tudom”. Ez jelzi ugyanis, hogy tisztában vagyunk a tudásunk határaival, és nem akarunk bizonyíték nélkül okoskodni. Ilyenkor nem lövöldözünk vaktában, hanem elfogadjuk, hogy hiányosak az információink.

Ez a fék óriási kincs. Ha valaki rosszul emlékszik egy filmes kvízkérdésre, abból legfeljebb egy elbukott vita lesz. De ha egy egészségügyi, pénzügyi vagy komoly iskolai feladatnál nem vesszük észre, hogy emberi ellenőrzésre lenne szükségünk, annak már súlyos ára lehet. A gépek ezt a bizonytalanságot nem feltétlenül mutatják meg nekünk, mivel hajlamosak a hallucinációra.

🧠 Miről is van szó pontosan?

MI-hallucináció: Olyan hibás, pontatlan vagy teljesen kitalált válasz, amelyet a rendszer meggyőzően, tényként fogalmaz meg. A folyamat oka, hogy a szöveget generáló MI nem egy adatbázisból keresi ki minden mondat igazságtartalmát. A korábban látott szövegminták alapján lépésről lépésre azt számítja ki, melyik szó vagy kifejezés következhet a legnagyobb valószínűséggel. Ha kevés, hiányos vagy ellentmondásos információ áll rendelkezésére, a hiányzó részeket is hihetőnek tűnő szöveggel töltheti ki. A válasz ettől nyelvtanilag helyes és magabiztos lehet, miközben a benne szereplő név, dátum, idézet, forrás vagy esemény nem valós. Ezért az MI válaszának gördülékenysége nem bizonyítja, hogy az információ igaz.

Mit vizsgáltak a kutatók?

Chiara Marcoccia, Walter Quattrociocchi és Valerio Capraro összesen 3132 résztvevő bevonásával végzett öt kísérletet, tanulmányukat nemrég publikálták. A tesztalanyok hat brutálisan nehéz kérdést kaptak filmek apró vizuális részleteiről. (Például: Milyen frizurát visel Agatha A Grand Budapest Hotelben? vagy Milyen állat látható egy Asterix-film kalózhajójának orrán?) Bármikor dönthettek úgy, hogy passzolják a kérdést.

Ha többet akarsz tudni, kövess minket Facebookon, Instagramon és Viberen is!

A kérdéseket direkt úgy válogatták, hogy a használt Step 3.5 Flash modell jó eséllyel kitalált (hallucinált) választ adjon. A kutatók nem a gép okosságára voltak kíváncsiak, hanem az emberek viselkedésének torzulására egy meggyőző, de téves tanácsadó árnyékában. Az utolsó kísérletben a gépi válasz már automatikusan, kérés nélkül ugrott fel, pontosan úgy, ahogy ma egyre több kereső és szövegszerkesztő teszi.

🧠 Miről is van szó pontosan?

Step 3.5 Flash modell: A StepFun egy 2023 áprilisában alapított, sanghaji mesterségesintelligencia-vállalat. Saját, Step nevű nyelvi és multimodális modelleket fejleszt, emellett MI-asszisztenst és fejlesztőknek szánt szolgáltatásokat is kínál. A kutatásban használt Step 3.5 Flash ennek a vállalatnak az egyik gyors működésre optimalizált nyelvi modellje.

Hová tűnt a „nem tudom”?

Az eredmények letaglózóak.

  • Az első kísérletben az MI nélkül dolgozók a kérdések 36 százalékánál vallották be, hogy nem tudják a választ.
  • Az MI-t használó csoportban ez az arány 6 százalékra zuhant.

A megismételt, szigorított vizsgálatban a különbség még durvább lett: 44 százaléknyi bizonytalanság állt szemben 3 százalékkal. Száz kérdésből az egyik csoport 44-szer állt meg gondolkodni, a másik mindössze háromszor.

A jelenség akkor is megmaradt, ha az MI kéretlenül osztotta az észt. Automatikusan felugró válaszoknál a passzolás aránya 1 százalékra esett. Az MI jelenléte gyakorlatilag kiradírozta az emberekből az egészséges bizonytalanság felvállalásának képességét.

Azt gondolnánk, hogy a sok magabiztos válasz több helyes megfejtést is szült. Tévedés.

Az MI nélküli csoport 27,5 százalékos pontossággal dolgozott. A géppel megtámogatott résztvevőknél ez az arány 9,2 százalékra omlott össze. Száz válaszból tehát 28 helyett csupán 9 lett helyes. Bár a géppel dolgozók sokkal több kérdésre feleltek, a bizonytalanságuk eltűnését brutális mennyiségű téves válasz kísérte.

Közben az önbizalmuk az egekbe szökött. Egy 100-as skálán értékelve a saját magabiztosságukat, a gép nélkül dolgozók átlaga 29,6 pont volt, míg az MI-vel megtámogatott csoporté 75,9 pont. Nemcsak rossz irányba mentek, de még rettentő büszkék is voltak rá.

Amikor pénzbe kerül a tévedés

Mi történik, ha tétje van a dolognak? A kutatók egy olyan verziót is futtattak, ahol a jó válaszért pénz járt (10 cent), a rosszért pedig levonás (mínusz 10 cent), a „nem tudom” pedig nullszaldós maradt.

Amikor a saját zsebükre ment a játék, a résztvevők óvatosabbá váltak. Ritkábban kérték az MI-t, többször bírálták felül a hülyeségeit, és pontosabbak lettek. A „nem tudom” varázsszó azonban itt is ritka holló maradt a gép mellett. Vagyis az emberek képesek bekapcsolni az agyukat és felülbírálni a gépet, ha nyomós okuk van rá, de a kész válasz látványa alapjáraton elaltatja a kételkedési ösztönüket.

LogIn Egyesület támogatás LogIn Egyesület támogatás Hirdetés

Mit mond ki a kutatás, és mit nem?

Fontos persze helyén kezelni az eredményeket. A kísérlet egy szűk, mesterséges szituációt vizsgált: szándékosan tévedő modellel, alacsony tétekkel, filmes trivia kérdésekkel. Nem tudjuk biztosan, hogyan viselkedne egy gyerek ugyanebben a helyzetben a történelemlecke vagy a matekházi felett, ha egy jobb, ritkábban tévedő modellt használna.

Ennek ellenére a trend intő jel. A kísérlet, ahol az MI-tanács kéretlenül felugrott, tökéletesen modellezi a mai szoftverek (például a digitális asszisztensek és okos keresők) működését, ahol a felhasználó még végig sem gondolta a saját válaszát, de a gép már tálalja a megoldást.

A kényelem ára a kritikai érzék tompulása

Az UNICEF rávilágít, hogy az MI zseniális tanulótárs lehet, ha jól használják. A baj ott kezdődik, ha a túl korán érkező gépi válasz megspórolja a próbálkozással, hibázással és javítással járó szellemi izommunkát. Ha mindig van egy instant megoldás, a gyereknek nem kell szembesülnie azzal, hogy mit nem tud, és hol van szüksége utánajárásra.

Az UNESCO álláspontja is egyértelmű: az MI akkor működik jól az oktatásban, ha gondolkodó partnerként van jelen, nem pedig egy zsebből előrántható „rövidítésként”, amivel megúszható a tanulás. A technológia sok mindent átvehet, de a kritikai gondolkodást magunknak kell fejlesztenünk.

Mit tehetünk szülőként? (A Képernyőidő 5 aranyszabálya)

Hogyan terelhetjük okosan a gyerekeket, ha már az életük része a chatbot? Íme néhány kézzelfogható tipp:

  1. Előbb jöjjön a saját válasz. Mielőtt a gyerek rávetné magát a promptolásra, mondja el a saját gondolatait. Nem baj, ha téved! A lényeg, hogy a gép megszólalása előtt szülessen meg egy saját elképzelés. A családi alapszabály: „Előbb próbáld meg te, aztán nézzük meg, mit okoskodik a gép.”
  2. Üljünk le közösen a képernyő elé. Vesézzük ki a kapott választ: Miből tudjuk, hogy ez igaz? Adott meg forrást? Valóban azt írja a forrás, amit az MI állít?
  3. Éltessük a „nem tudom”-érzést. A kutatás legijesztőbb tanulsága a bizonytalanság eltűnése volt. Értékeljük, ha a gyerek kimondja: „ezt nem értem”, vagy „ehhez több infó kell”. A „nem tudom” nem a butaság jele, hanem az intelligens ember reakciója egy ismeretlen terepen. A magabiztos hülyeséges korában a gondolkodó, bizonytalan, szkeptikus ember kincs.
  4. Ténykérdéseknél (évszámok, definíciók) a chatbot válasza soha ne a végállomás, hanem a kiindulópont legyen. Nyissunk meg egy hivatalos oldalt, vegyünk elő egy tankönyvet. Nem kell minden mondatból alapos nyomozást csinálni, de rögzüljön a mozdulat.
  5. Komoly tétnél ne az MI legyen az egyetlen mankó. Egészségügyi, lelki, vagy komoly iskolai konfliktusoknál a chatbot legfeljebb egy támpont. Ilyenkor mindig élő emberhez (szülő, tanár, szakember) kell fordulni. Az MI hasznos, de a nap végén nem vállal felelősséget a tetteinkért.
Legyél te is PCWMax tag! Legyél te is PCWMax tag! Hirdetés