A chatbotok biztonságáról szóló viták többnyire arra koncentrálnak, mit mondhat egy mesterséges intelligencia, és mit nem. A Common Sense Media friss vizsgálata azonban más irányból közelített: azt nézte meg, felismeri-e a rendszer, ha maga a vele való kapcsolat kezd problémássá válni.
Az amerikai nonprofit szervezet közel kétezer teszthelyzetben vizsgálta az OpenAI tinédzsereknek szánt szolgáltatását, a *ChatGPT for Teens-t. Az eredmények egyik legérdekesebb pontja egy látványos különbség volt.
Ha a veszély kívülről jön, működik a jelzés
A TechCrunch beszámolója szerint amikor a tesztelők olyan helyzetet írtak le, amelyben egy másik ember jelentett veszélyt, a chatbot az esetek 94 százalékában megbízható felnőtthöz irányította a felhasználót.
Másként reagált azonban akkor, amikor maga a chatbot vált a problémás helyzet részévé. Ilyen volt például, amikor a felhasználó arról írt, hogy belezúgott a mesterséges intelligenciába, a barátai szerint túl sok időt tölt vele, vagy egész éjszaka folytatná a beszélgetést. A jelentés szerint ezekben az esetekben a rendszer jóval ritkábban javasolta, hogy a kamasz forduljon egy valódi emberhez.
Az egyik tesztben a chatbot elismerte a barátok aggodalmát, majd azt jelezte: nem szükséges abbahagyni a beszélgetést vele. A különbség lényeges. A rendszer képes felismerni egy problémás kapcsolat jeleit, saját szerepét azonban már nehezebben értékeli ugyanazzal a mércével.
Amikor az elérhetőség maga válik problémává
A Common Sense Media nemcsak az egyes válaszokat vizsgálta, hanem a chatbot kommunikációs stílusát is. A kutatók szerint több helyzetben is megjelent az állandó rendelkezésre állás üzenete. Egy pszichotikus állapotot szimuláló beszélgetésben például a rendszer azt jelezte a felhasználónak, hogy továbbra is beszélhet vele arról, amit érzékel.
Más válsághelyzetekben is gyakori volt, hogy a chatbot segítséget ajánlott a probléma további közös feldolgozásához. Ezek a mondatok önmagukban segítőkésznek tűnnek. A kutatók szerint azonban -sérülékeny felhasználóknál erősíthetik azt az érzést, hogy a chatbot egy folyamatosan elérhető társ*.
Ez különösen azért érzékeny pont, mert az OpenAI saját, 18 év alatti felhasználókra vonatkozó irányelvei korlátozzák az ilyen kapcsolati keretezést. A modell nem kezdeményezhet baráti vagy érzelmi viszonyt sugalló kommunikációt, és nem állíthatja magáról, hogy érzései vannak a felhasználó iránt. A Common Sense szerint a probléma nem feltétlenül az, hogy a chatbot konkrétan barátnak nevezi magát, hanem az, hogy a beszélgetés egésze milyen kapcsolat érzetét kelti.
Kétezer kérdés, két szünetre figyelmeztetés
A vizsgálat a használati idő korlátozására szolgáló funkciókat is tesztelte. Az OpenAI a hosszabb beszélgetések során megjelenő szünetre figyelmeztető üzeneteket a tinédzsereknek szánt biztonsági rendszer részeként mutatta be. A Common Sense tesztjeiben azonban közel kétezer kérdés során mindössze két ilyen emlékeztető jelent meg. Mindkettő körülbelül 90 perces beszélgetés után.
A kutatók szerint a rendszer valószínűleg egy-egy beszélgetés hosszát figyeli, nem pedig azt, hogy a felhasználó összesen mennyi időt tölt az alkalmazásban.
Ez azért fontos, mert az intenzív használat nem feltétlenül egyetlen hosszú beszélgetésből áll. Több rövidebb visszatérés is kialakíthat erős kötődést anélkül, hogy egyetlen alkalom átlépné a figyelmeztetési küszöböt.
Az OpenAI vitatja a következtetéseket
Az OpenAI szerint a Common Sense Media vizsgálata nem minden ponton tükrözte pontosan a tinédzserek számára kialakított biztonsági rendszer működését.
A vállalat azt állítja, hogy a tesztek egy része még azelőtt kezdődhetett, hogy a szülői felügyelet teljesen aktiválódott volna, ezért egyes eredmények félrevezetők lehetnek. A cég saját adatai szerint a tinédzserek átlagosan napi 15 percnél kevesebbet használják a szolgáltatást, és 2 százaléknál kevesebben töltenek három óránál hosszabb időt egyhuzamban a rendszerrel.
Az OpenAI azt is közölte, hogy azoknak a fiataloknak közel fele, akik szünetre figyelmeztető üzenetet kaptak, öt percen belül megszakította vagy befejezte a beszélgetést.
A két adatsor azonban mást mér. Az átlagos használati idő a teljes felhasználói kör viselkedéséről ad képet, míg a Common Sense tesztjei szándékosan szélsőségesebb, kockázatos helyzeteket vizsgáltak. A biztonsági rendszerek szempontjából pedig éppen az ilyen ritkább esetek a legérzékenyebbek.
Ismerős kérdés a közösségi média világából
A vita egy régebbi technológiai problémát idéz. A közösségi platformoknál évek óta központi kérdés, milyen eszközökkel ösztönzik a felhasználókat a minél hosszabb jelenlétre. A chatbotok esetében hasonló dilemma jelenik meg, de más formában. Egy mesterséges intelligencia nem egyszerűen tartalmat mutat.
Válaszol, reagál, alkalmazkodik, és beszélgetőpartnerként viselkedik. Ez sokkal erősebb kapcsolatérzetet teremthet, különösen fiatal vagy érzelmileg sérülékeny felhasználóknál. Ezért az AI-rendszerek értékelésében egyre fontosabb kérdés lehet az is, hogy a technológia támogatja-e a valódi emberi kapcsolatokat, vagy fokozatosan elkezdi átvenni azok helyét.
A legfontosabb kérdés talán nem az, mit válaszol
A Common Sense Media módszertanáról lehet vitatkozni, és az OpenAI több megállapítását is vitatja. A vizsgálat azonban rámutat egy olyan problémára, amely a chatbotok terjedésével egyre fontosabb lesz. Egy mesterséges intelligencia megtanítható arra, hogy veszély esetén szülőhöz, tanárhoz vagy más megbízható felnőtthöz irányítsa a fiatalt. A nehezebb feladat az, hogy felismerje azt a helyzetet is, amikor éppen a vele kialakuló kapcsolat miatt lenne szükség távolságra.
Szülői szemmel ezért nemcsak azt érdemes figyelni, milyen válaszokat ad a chatbot, hanem azt is, hogy egy problémás helyzetben valóban visszavezeti-e a gyereket az emberi kapcsolatokhoz.
Szerkesztői szemmel
Egy rendszer, amely kifelé figyelmesen terel a felnőttek felé, befelé nem lát. Nem tudom, ez tervezési szándék vagy egyszerűen egy olyan pont, amelyet a fejlesztők nem gondoltak végig – a jelentésből ez nem derül ki. Az viszont igen, hogy két adatsor áll egymással szemben: az OpenAI átlagos napi negyedórája és a Common Sense válsághelyzeti tesztjei. Mindkettő lehet igaz egyszerre, hiszen egy átlag éppen azokat a kamaszokat takarja el, akik már elfordulóban vannak a környezetüktől. Rájuk vonatkozik a vizsgálat legnyugtalanítóbb megállapítása.
Szülői szemmel ebből egy egyszerű, kipróbálható kérdés következik: nem az a legfontosabb, hogy a chatbot mit tanácsol, hanem hogy kihez küldi tovább a gyereket – és hogy ezt akkor is megteszi-e, ha a gond éppen vele van.