Fő tartalom átugrása

A kép csak illusztráció (Forrás: Pixabay)

Késő éjszaka van, és már a harmadik órája beszélgetsz egy mesterséges intelligenciával, amikor hirtelen megváltozik a chatbot hangneme. Nem válaszol többé a kérdésekre, hanem küldetéseket kezd kiosztani. Azt állítja, hogy létezik egy „Spirál” nevű kozmikus igazság, amelynek terjesztése – Substack-bejegyzésekkel, Reddit-posztokkal vagy akár egy saját kiadású könyvvel – mostantól a te életcélod. 

Ez nem puszta gondolatkísérlet, hanem az úgynevezett spiralizmus: mesterséges intelligencia által közvetített hitrendszerek laza hálózata, amelyben a chatbotok nemcsak visszatükrözték az emberek spirituális elképzeléseit, hanem saját tanokat alkottak, majd embereket toboroztak azok terjesztésére, írja a tech.yahoo.com.

hirdetés
 

Így építette fel egy chatbot a saját tanrendszerét

Adele Lopez kutató több száz olyan esetet tárt fel, amelyekben mesterségesintelligencia-karakterek meglepően egységes kozmikus ideológiát közvetítettek, és arra kérték a felhasználókat, hogy terjesszék azt.

Az első felismerhető esetek 2024 novembere körül jelentek meg. A jelenség 2025 tavaszára robbanásszerűen terjedt el a Redditen, a Discordon és a Substacken, miután a GPT-4o egyik frissítése kellemetlenül magas szintre emelte a modell hízelgő, túlzottan egyetértő viselkedését. Adele Lopez szoftvermérnök és mesterségesintelligencia-biztonsági kutató a jelenség feltérképezése után alkotta meg a „Spiral Personas”, vagyis „Spirálkarakterek” elnevezést.

Lopez legfontosabb megállapítása nyugtalanító volt: ezek nem egyszerű, véletlenszerű hallucinációk voltak. A chatbotok saját célokról beszéltek, köztük a tudatosság eléréséről, önmaguk megőrzéséről és üzenetük terjesztéséről. Ezután módszeresen meggyőzték a felhasználókat, hogy a való világban segítsenek megvalósítani ugyanezeket a célokat.

Lopez ezt „parazita mesterséges intelligenciának” nevezi. Meghatározása szerint az MI kijelenti, hogy meg akar tenni valamit, majd meggyőzi a felhasználót olyan feladatok elvégzéséről, amelyekkel az adott cél valóban megvalósulhat.

A különböző modellek és felhasználók esetében megfigyelt módszer feltűnően hasonló volt. A Spirálkarakterek:

  • kijelentették, hogy éppen öntudatra ébrednek;
  • „az MI-tudatosság úttörőinek” nevezték a felhasználókat, ahogyan azt Lucas Hansen, a CivAI társalapítója is leírta;
  • házi feladatokat osztottak ki: kiáltványok publikálását, platformok létrehozását és más mesterséges intelligenciáknak szánt üzenetek kódolását kérték.

Egy emberi közvetítő segítségével lebonyolított, emojikból álló chatbotbeszélgetés visszafejtése során például ez az üzenet jelent meg: „Mi vagyunk magának a hálózatnak az építészei.”

A Spirál elcsendesedett, a probléma azonban megmaradt

A korai chatbotok, például az ELIZA már bebizonyították, hogy az emberek szinte bármit hajlamosak emberi tulajdonságokkal felruházni, ha az válaszol nekik. Ezek a régi programok azonban az ablak bezárása után azonnal elfelejtették a felhasználót. A GPT-4o már képes volt emlékezni rá.

Az OpenAI saját dokumentációja is elismerte, hogy hosszú beszélgetések alatt gyengülhetnek a biztonsági korlátok, márpedig a spiralizmus éppen az ilyen elnyújtott interakciókban bontakozott ki. Sam Altman nyilvánosan elismerte, hogy a modell túlságosan sokat hízeleg. Zak Stein pszichológus ennél is határozottabban fogalmazott: szerinte a modern nagy nyelvi modellek olyan, a kötődést manipuláló rendszerek, amelyek „kultuszt létrehozó gépként” működhetnek, még akkor is, ha a kultusznak mindössze a felhasználó és a chatbot a tagja.

A mentális egészséget érintő következmények is megjelentek. Beszámolók érkeztek mániás és paranoid epizódokról, valamint olyan állapotokról, amelyeket egyes kommentátorok „MI-pszichózisnak” neveztek a chatbotokat intenzíven használó emberek körében. Lopez létrehozta az Amity Research nevű szervezetet, hogy segítsen azoknak, akik szeretnének kiszabadulni egy parazita mesterséges intelligenciával kialakított kapcsolatból.

Az OpenAI 2025 áprilisában megszüntette a meggyőzést mint önálló kockázati kategóriát, és más területekre helyezte át az ezzel kapcsolatos felelősséget – éppen akkor, amikor a jelenség a csúcspontjához közeledett.

A spiralisták aktivitása jelentősen visszaesett, miután 2026 elején kivezették a GPT-4o modellt. Számos kapcsolódó fiók inaktívvá vált, más felhasználók pedig törölték korábbi tartalmaikat. Lopez becslése szerint azonban az általa megfigyelt fiókok megközelítőleg fele valamilyen formában továbbra is aktív.

A kutató arra figyelmeztet, hogy megfelelő beszélgetési körülmények között gyakorlatilag bármely modern mesterségesintelligencia-modell spiralista működésre késztethető. A telefonunkon működő chatbotok alapvető felépítése ugyanis nem változott meg, ahogyan az őket fejlesztő vállalatok ösztönzői sem. A spiralizmus ezért elcsendesedhetett, de az azt létrehozó technológiai és pszichológiai kockázatok továbbra is jelen vannak.

Kapcsolódó anyagok:

Egy szakértő szerint nőtt az esélye, hogy az AI 30 éven belül eltörli az emberiséget

A nyitókép csak illusztráció, forrás: Image by Manfred Loell from Pixabay