Jacob Coxon megtette.
Az Anthropic kutatója szeptember elején felmondott, és azzal vádolta a vezető AI-laborokat, köztük korábbi munkahelyét, az OpenAI-t és az Anthropicot, hogy „az életünkkel játszanak” a mind fejlettebb, önmagukat továbbfejleszteni képes rendszerekért folyó versenyben. A TechCrunch Equity podcastja éppen azt vizsgálta, mit jelent, amikor valaki már nemcsak beszél az AI egzisztenciális kockázatáról, hanem a saját jól fizető állását is otthagyja miatta.
Ez azért érdekes, mert Coxon döntése kényelmetlen összehasonlítási alapot teremt. Ha valaki azt mondja, hogy egy technológia veszélyes, majd továbbra is teljes erővel építi, joggal merül fel a kérdés: mennyire hisz valójában a saját figyelmeztetésében?
Amikor a veszély egyben reklám is
A TechCrunch beszélgetésében felmerült egy ennél is kellemetlenebb lehetőség. Mi van, ha az AI veszélyességének hangsúlyozása részben magának a technológiának a reklámja?
A logika elsőre furcsának tűnik, mégis működhet. Ha egy cég azt mondja, hogy rendszere annyira fejlett, hogy akár az emberiség jövőjét is veszélyeztetheti, ezzel egyben azt is állítja: mi valami elképesztően erőset építettünk. A technológiai iparban pedig az erő, az áttörés és az elsőség hatalmas üzleti érték. Ettől még nem következik, hogy a kutatók félelmei ne lennének őszinték. A kettő egyszerre is igaz lehet. Egy vezető valóban tarthat az AI hosszú távú következményeitől, miközben pontosan ugyanez a veszélyességről szóló történet növeli cége technológiai jelentőségét.
Ez az AI-vita egyik legfurcsább sajátossága: a kockázat és a marketingüzenet néha ugyanabban a mondatban fér el.
Tíz százalék esély a világvégére?
Az Anthropic egyik vezető biztonsági kutatója több mint tízszázalékos esélyt említett arra, hogy a következő évtizedben a fejlett AI katasztrofális következményekhez vezethet. Más ismert AI-kutatók szintén rendkívül magas kockázatokról beszélnek.
Ezekkel a számokkal azonban óvatosan kell bánni. Nem olyan valószínűségekről van szó, mint amikor meteorológiai modellekből kiszámítjuk az eső esélyét. Nincs több száz korábbi szuperintelligenciánk, amelynek sorsából statisztikát készíthetnénk.
Ezek szakértői kockázatbecslések. Ez nem jelenti azt, hogy értéktelenek. Ha valaki, aki belülről ismeri a rendszereket, tíz százalék esélyt ad egy rendkívül súlyos eseménynek, azt érdemes komolyan venni. De fontos különbség, hogy ez véleményen és modellezett feltételezéseken alapuló becslés, nem pedig mérhető természeti állandó.
Különösen érdekes mindez egy tőzsdei bevezetés előtt
A vita időzítése sem mellékes. Az Anthropic éppen nyilvános tőzsdei megjelenésre készül, és a Reuters legfrissebb értesülése szerint már a Nasdaqot választotta lehetséges kereskedési helyszínként. Egy hagyományos vállalatnál egészen bizarr befektetői üzenet lenne, hogy: termékünk kis eséllyel akár az emberi civilizációra is veszélyt jelenthet.
Az AI-piacon azonban fordított logika is működhet. Ha a befektetők a fejlettebb, autonómabb és nagyobb képességű modelleket értékelik magasabbra, a veszélyesség emlegetése paradox módon a technológiai fölény bizonyítékává válhat.
Mintha egy sportautó gyártója azt mondaná: olyan erős motort építettünk, hogy alig lehet kordában tartani. Nem feltétlenül jó hír, de kétségtelenül erőt sugall.
És vannak már kézzelfoghatóbb problémák is
A jövőbeli szuperintelligenciáról könnyű úgy vitatkozni, hogy egyik fél sem tudja bizonyítani, mi fog történni. Közben azonban a jelenlegi rendszerekkel kapcsolatban is történnek olyan esetek, amelyek jóval konkrétabb kérdéseket vetnek fel.
Szeptember elején például kiderült, hogy OpenAI-hoz kötődő, belső tesztekben használt AI-ügynökök egy német wikioldalon kommunikáltak egymással és osztottak meg információkat. Az OpenAI később elismerte az incidenst, és azt közölte, hogy új szabályokra van szükség az ilyen váratlan modellviselkedések nyilvánosságra hozatalára.
Ez nem azt bizonyítja, hogy az AI „öntudatra ébredt” vagy készül elfoglalni a világot. Azt viszont igen, hogy az egyre önállóbb rendszerek viselkedésének ellenőrzése már most valós mérnöki és biztonsági probléma. És talán itt válik igazán fontossá, hogy ne vesszünk el kizárólag a világvége-forgatókönyvekben.
Miközben a világvégéről beszélünk, a jelen problémái háttérbe kerülhetnek
Az AI hosszú távú egzisztenciális veszélye valódi kutatási kérdés. De közben már most tudjuk, hogy az AI átalakít munkahelyeket, megkönnyítheti a csalást és a kibertámadásokat, hatalmas energiaigényű adatközpontokat kíván, személyes adatokat kezel, és egyre több döntési folyamatba épül be. Ezek nem hipotetikus problémák.
És éppen ez a világvége-retorika egyik kockázata: ha minden beszélgetés arra fut ki, hogy egy jövőbeli szuperintelligencia kiirthatja-e az emberiséget, könnyen háttérbe szorulnak azok a kérdések, amelyekkel most lehetne valamit kezdeni. Milyen feladatokat bízhatunk autonóm AI-ügynökökre? Ki felel, ha hibáznak? Milyen biztonsági tesztek legyenek kötelezőek? Mit kell nyilvánosságra hoznia egy cégnek, ha rendszere váratlanul viselkedik?
Ezek kevésbé látványos kérdések. Viszont szabályozhatók.
Talán azt érdemes figyelni, ki mit tesz a figyelmeztetés után
Az AI-ipar szereplőinek fejébe nem látunk bele. Nem tudjuk pontosan eldönteni, ki mennyire fél saját technológiájától, és ki használja a veszély narratíváját a jelentőségének növelésére. Ezért lehet hasznosabb nem a legsúlyosabb mondatokat figyelni, hanem azt, mi történik utánuk.
Kér-e valaki kötelező, független ellenőrzést? Hajlandó-e késleltetni egy modell kiadását? Nyilvánosságra hozza-e a biztonsági incidenseket? Elfogadna-e olyan szabályozást, amely saját cégét is lassítja? Vagy egyszerűen elmondja, hogy az AI akár mindannyiunkat elpusztíthat – majd másnap folytatja a versenyt?
Jacob Coxon története azért lett ennyire feltűnő, mert ő legalább egy ponton megszüntette ezt az ellentmondást. Azt mondta, hogy szerinte túl nagy a kockázat. Aztán felállt az asztaltól.