Mennyire emberi az AI? - pszichológiai teszten a ChatGPT

Mit lát a mesterséges intelligencia egy tintafoltban? És mit árul el mindez róla vagy éppen rólunk?

Az elmúlt néhány évben elképesztő gyorsasággal vált mindennapjaink részévé a mesterséges intelligencia. Beszélgetünk vele, tanácsot kérünk tőle, szöveget íratunk vele, problémákat oldunk meg közösen. És minél többet használjuk, annál könnyebb megfeledkezni egy alapvető tényről: a képernyő másik oldalán nincs egy másik ember. De vajon mennyire „emberi” az, ahogyan egy mesterséges intelligencia értelmezi a világot?

Egy 2026-ban a JMIR Mental Health folyóiratban megjelent, magyar kutatók által végzett vizsgálat erre egy rendkívül érdekes kísérlettel kereste a választ: Rorschach-tesztnek vetettek alá három vezető mesterségesintelligencia-modellt. Izgalmas kísérlet, lássuk milyen eredménnyel zárult

Tintafoltok az AI előtt

A Rorschach-teszt több mint százéves pszichológiai vizsgálati módszer. A vizsgált személynek tíz szimmetrikus tintafoltot mutatnak, és felteszik az egyszerű kérdést:

„Mi lehet ez?” A képeknek nincs egyetlen helyes megfejtésük. Éppen az a lényeg, hogy az ember miként szervezi jelentéssé a bizonytalan vizuális információt: mit vesz észre, mire koncentrál, embereket vagy állatokat lát-e, mozgást érzékel-e, milyen történetet kapcsol a látottakhoz.

Csigó Katalin és Cserey György kutatásában ugyanezt a tíz klasszikus Rorschach-táblát mutatták meg három multimodális AI-nak: GPT-4o-nak, Grok 3-nak és Gemini 2.0 Flash Thinkingnek.

Ezután a válaszokat a Rorschach-vizsgálatban használt szempontok szerint elemezték. És érdekes dolog történt.

Az AI is „látott” valamit

A modellek nem egyszerűen geometriai formákat vagy fekete és színes foltokat azonosítottak.

Embereket láttak. Állatokat. Mozgást. Találkozásokat. Táncot. Rituálékat. Maszkokat. Fantázialényeket.

Ráadásul a három AI egészen eltérő módon reagált ugyanazokra a képekre. A GPT-4o válaszainak 86,7%-a, a Grok válaszainak 90%-a az egész tintafoltot használta fel az értelmezéshez. A Gemini ezzel szemben az esetek 80%-ában inkább egy-egy részletre koncentrált.

Még érdekesebb különbség jelentkezett az emberi mozgások felismerésében. A GPT-4o válaszainak 46,7%-ában jelent meg emberi mozgás. A Groknál ez 30%, a Gemininél mindössze 5% volt. Mintha ugyanazt a bizonytalan vizuális világot három különböző „személyiség” nézte volna. Csakhogy természetesen nem személyiségekről van szó.

A ChatGPT történeteket kezdett mesélni

A GPT-4o különösen gazdag emberi és érzelmi értelmezéseket adott. Egyes tintafoltokban együttműködő embereket, táncot, játékot vagy beszélgetést vélt felismerni. Máskor rituális, misztikus vagy drámai jeleneteket alkotott. Megjelentek istenek, varázslók, démoni alakok, maszkok, köpenyek és jelmezek is. És néha ennél is tovább ment. Egy egyszerű tintafoltból részletes, koherens történetet épített fel, vagyis nem pusztán azt mondta meg mit „lát”, hanem elkezdte megmagyarázni, mi történik a képen. A pszichológiában ezt a jelenséget konfabulációként is értelmezhetjük: a hiányos információ köré egy összefüggő történet épül. Az AI esetében azonban ennek egészen más magyarázata lehet.

Pontosan azt teszi, amire létrehoztuk: hiányos információból megpróbál valószínű és koherens jelentést létrehozni. És talán éppen ez az egyik oka annak, hogy időnként ennyire emberinek érezzük.

Amikor az AI „emlékezni” kezd

A vizsgálat talán legkülönösebb része azonban még csak ezután következett. A GPT-4o és a Grok egyes válaszaiban személyes emlékekhez hasonló történetek jelentek meg. Az egyik modell például úgy fogalmazott, mintha emlékezne arra, hogy gyerekkorában az iskolában festéket fröcsköltek egy papírra, majd összehajtották azt. Csakhogy egy mesterséges intelligenciának természetesen nem volt gyerekkora. Nem ült iskolapadban, nem festett papírra és nincs ilyen emléke. Mégis tökéletesen képes olyan nyelvet használni, amely bennünk egy személyes emlék benyomását kelti. És ez már jóval túlmutat egy érdekes pszichológiai kísérleten.

Miért érezzük ennyire emberinek?

Az emberi agy rendkívül könnyen tulajdonít emberi tulajdonságokat olyan dolgoknak is, amelyek valójában nem emberek. Arcokat látunk felhőkben, emberi érzelmeket tulajdonítunk állatoknak, sőt néha még tárgyaknak is. Egy modern chatbot ennél sokkal erősebb ingert jelent. Megérti a kérdésünket, emlékszik a beszélgetés előzményeire, udvarias, humorizál, együttérző mondatokat fogalmaz. Első személyben beszél és képes reagálni arra, ha szomorúak vagyunk, képes úgy beszélni egy élményről, mintha maga is átélte volna.

Mindez nagyon erős emberi jelenlétérzést hozhat létre.

A Rorschach-kísérlet azonban fontos figyelmeztetés. Attól, hogy a válasz emberinek hangzik, még nem következik, hogy mögötte emberi élmény van.

Akkor van személyisége a ChatGPT-nek?

A kutatás alapján erre nem mondhatunk igent és a szerzők maguk is kifejezetten óvnak attól, hogy a Rorschach-válaszokból valódi személyiséget, tudatosságot vagy pszichés állapotot tulajdonítsunk a mesterséges intelligenciának. A GPT-4o nem lett „paranoiás”, mert bizonyos képekben maszkokat vagy fenyegető alakokat látott. Nem vált spirituálissá azért, mert rituális jeleneteket írt le. És természetesen nem lett gyermekkori emléke sem, a jelenség valószínűleg sokkal érdekesebb ennél.
A nagy nyelvi modelleket óriási mennyiségű, emberek által létrehozott szövegen és más tartalmakon tanították. Regények, történetek, beszélgetések, leírások, tudományos szövegek és az emberi kultúra számtalan más lenyomata jelenik meg bennük. Amikor tehát egy AI egy értelmetlen tintafoltban két táncoló embert, egy maszkot, egy démont vagy egy rituálét „lát”, talán nem saját belső világát mutatja meg nekünk. Hanem valamennyire a miénket.

Azért van egy fontos „de”

Ez egy izgalmas, de kisméretű, feltáró kutatás. Mindössze három AI modellt vizsgáltak, modellenként egyetlen tesztfelvétellel. Nem volt emberi kontrollcsoport és nem történt klasszikus értelemben vett pszichometriai validáció sem. Van még egy fontos probléma: a Rorschach-táblák több mint száz éve léteznek, képeik és értelmezéseik széles körben hozzáférhetők az interneten, ezért nem lehet biztosan kizárni, hogy a modellek tréningjük során már találkoztak velük.

Egy következő vizsgálatban ezért sokkal érdekesebb lenne teljesen új, korábban soha nem publikált tintafoltokat mutatni az AI-nak, majd a válaszait nagy számú ember válaszaival összehasonlítani. A mostani eredményeket ezért nem szabad túlértelmezni, de ettől még felvetnek egy nagyon fontos kérdést.

Lehet, hogy rosszul tesszük fel a kérdést?

Talán nem azt kell kérdeznünk: „Mennyire hasonlít az AI az emberre?”

Hanem inkább ezt: „Miért tud egy gép ennyire meggyőzően emberinek látszani?”

A válasz egyik része valószínűleg bennünk keresendő. A mesterséges intelligencia az emberi gondolkodás, nyelv és kultúra hatalmas mennyiségű lenyomatából tanult. Amikor beszélgetünk vele, ezekből a mintázatokból épít fel számunkra értelmes válaszokat. Ezért a Rorschach-teszt ebben a kísérletben talán nem is egyszerűen a mesterséges intelligencia tükre volt.

Hanem egy különös tükör, amelyen keresztül az AI az emberi kultúra egy részét tükrözte vissza ránk.

És talán éppen ettől olyan lenyűgöző - és néha kissé nyugtalanító - vele beszélgetni.

Forrás: Csigó K, Cserey G. Human Shadows in Machine Minds: Quantitative Analysis of Artificial Intelligence Responses to the Rorschach Test. JMIR Mental Health, 2026;13.