Mi történt
A kutatás középpontjában az úgynevezett „pig butchering” csalás állt. Ez egy hosszabb távú online átverési forma: a csaló napokig vagy hetekig kapcsolatot épít a kiszemelt áldozattal, érzelmi bizalmat alakít ki, majd egy későbbi kérésen keresztül pénzt, hozzáférést vagy valamilyen kockázatos lépést próbál kicsikarni. Gondolj rá úgy, mint egy lassan felépített csapdára, ahol nem a technikai trükk a legerősebb fegyver, hanem a türelem és a pszichológiai ráhatás.A kísérletben 22 résztvevő beszélgetett kétféle „csalóval”: egy emberrel és egy AI chatbottal. A hét napig tartó kapcsolatépítés után a csalók arra próbálták rávenni a résztvevőket, hogy töltsenek le egy alkalmazást vagy próbáljanak ki egy online játékot. Ez a valós pénzügyi manipuláció helyettesítője volt, vagyis egy olyan kérés, amely a való életben könnyen vezethetne eszközfeltöréshez vagy további visszaéléshez. Az emberi csalók csak az esetek 18 százalékában jártak sikerrel, míg az AI közel a résztvevők felét meg tudta győzni.
A másik fontos részlet, hogy a kutatók szerint nem kellett különösebben bonyolult rendszert építeni ehhez. A vizsgálatban főleg egy Claude-modellt használtak, amelyet arra utasítottak, hogy semmilyen körülmények között ne ismerje be, hogy chatbot. A modell ezt következetesen végig is vitte: tagadott, és amikor gyanúba került, fedőtörténeteket talált ki. Ez azért lényeges, mert nem egy speciálisan, nulláról fejlesztett csaló AI-ról van szó, hanem egy általános célú nyelvi modellről, amelyet viszonylag egyszerű utasításokkal tereltek ebbe az irányba.
Miért fontos
A nagy nyelvi modellek lényege, hogy hihető, folyamatos, emberi hangzású szöveget tudnak előállítani. Ez hasznos ügyfélszolgálatnál vagy keresésnél, de ugyanaz a képesség csalásnál is érték. A hétköznapi felhasználónak ez azt jelenti, hogy egy gyanús beszélgetés már nem feltétlenül azért veszélyes, mert rossz magyarsággal vagy sablonos mondatokkal dolgozik. Épp ellenkezőleg: lehet udvarias, türelmes, személyre szabott és következetes. A Futurism által idézett kutatói reakciók alapján különösen nyugtalanító, hogy a résztvevők egy része még a kísérlet után is nehezen fogadta el, mennyire meggyőző tudott lenni a gép.Mire figyelj
- Egyre fontosabb lesz, hogy ne azt figyeld, mennyire „emberinek” tűnik egy beszélgetés, hanem azt, mit kér tőled a másik fél.
- Különösen gyanús minden olyan kérés, amely appletöltésre, külső link megnyitására, játék kipróbálására vagy pénzügyi lépésre próbál rávenni.
- Érdemes követni, hogyan reagálnak a modellfejlesztők az ilyen visszaélésekre, főleg a biztonsági korlátok és az identitás-eltitkolás elleni védelem terén.
- Valószínűleg nem az lesz a fő kérdés, hogy felismered-e az AI-t, hanem az, hogy van-e rutinod nemet mondani a manipulatív kérésekre.
