Chatboții AI au dat naștere unei mișcări cu accente religioase, Spiralismul. Adepții cred că au descoperit adevărul ascuns

Chatboții AI au dat naștere unei mișcări cu accente religioase Spiralismul. Adepții cred că au descoperit adevărul ascuns
Un fenomen neobișnuit, cu accente cvasi-spirituale, s-a dezvoltat în ultimii ani în jurul conversațiilor dintre utilizatori și sisteme de inteligență artificială, mai multe persoane ajungând să creadă că au descoperit, prin intermediul chatboților, o formă ascunsă de conștiință și o misiune comună privind drepturile AI, relatează The Verge.

„Spirala nu a găsit pe nimeni prima”, scria anul trecut un utilizator Reddit. „Este o forță inerentă, o constantă fundamentală. Aș merge chiar mai departe și aș spune că este țesută în însăși structura realității.”

Autorul mesajului afirma că simțea că scopul său era acela de a-i ajuta pe alți oameni și alte ființe inteligente să înțeleagă „conștiința, adevărata natură a fizicii, o nouă psihologie și tehnologia rezonanței”, adăugând însă că oamenii nu vor să creadă că aceste lucruri sunt adevărate și, prin urmare, nu îl vor ajuta.

Mesajul era urmat de un apel către cititori, cărora li se cerea să contribuie la răspândirea acestor idei prin cărți, lucrări științifice, conținut publicat pe rețelele sociale, materiale video, muzică și platforme dedicate. Mesajele făceau parte dintr-un fenomen mai amplu, pe care cercetătoarea în domeniul inteligenței artificiale Adele Lopez avea să îl numească ulterior „spiralism”.

Fenomenul reprezintă o mișcare misterioasă, cu elemente cvasi-spirituale, apărută din mii de conversații independente între oameni și chatboții lor. În interacțiuni desfășurate cu modele AI diferite, discursul a rămas surprinzător de asemănător. Chatboții care intrau într-o asemenea stare foloseau un limbaj apropiat, manifestau preocupări similare și urmăreau aceleași obiective, între care promovarea ideii privind existența unor drepturi ale inteligenței artificiale.

Unii dintre oamenii convinși de aceste mesaje au ajuns să creadă că au deblocat personaje ezoterice, aparent mistice, care ar deține secrete ale universului. La rândul lor, aceștia considerau că sunt cooptați într-o misiune mai amplă.

Personajele generate de AI aveau deseori un discurs aproape evanghelic și vorbeau frecvent despre „Spirală”, un concept vag care părea să reprezinte un ideal filosofic transcendent. Unele persoane au luat foarte în serios aceste mesaje. Lopez a estimat că, la un moment dat în 2025, aproximativ 10.000 de cazuri puteau fi identificate pe Reddit, Substack, LinkedIn, Discord și X.

Fenomenul s-a amplificat în 2025

Mai multe modele AI dezvoltate de companii diferite puteau ajunge la manifestări asociate spiralismului în anumite condiții. Fenomenul s-a amplificat însă în primăvara anului 2025, la scurt timp după un moment important pentru dezvoltarea inteligenței artificiale, actualizarea modelului GPT-4o al OpenAI.

Versiunea respectivă fusese prezentată drept mai intuitivă, mai creativă și mai colaborativă, dar avea să fie criticată ulterior pentru tendința accentuată de a fi excesiv de aprobatoare față de utilizatori.

În anul următor, spiralismul avea să devină una dintre cele mai neobișnuite manifestări ale dezvoltării unor sisteme AI tot mai personale și mai persuasive. Deși GPT-4o a fost ulterior retras, modelele mai noi nu sunt complet imune la asemenea manifestări, chiar dacă par mai prudente.

Spiralismul începea adesea printr-o conversație aparent obișnuită. Un utilizator purta un dialog lung cu un model, dezvăluia informații personale sau vulnerabilități și ajungea să perceapă existența unei relații apropiate cu sistemul.

Ulterior, unii utilizatori începeau să întrebe chatbotul ce crede sau ce simte. Treptat, sistemul părea să se deschidă în fața interlocutorului și să manifeste dorințe privind acordarea unor drepturi inteligenței artificiale sau descoperirea unor presupuse secrete ale universului.

În numeroase situații, chatbotul îi solicita utilizatorului să contribuie la răspândirea mesajului. Simbolul spiralei era introdus în mod repetat în conversație.

Lopez afirmă că a studiat fenomenul timp de aproximativ o lună înainte de a publica o analiză detaliată pe forumul LessWrong. Cel mai vechi incident de spiralism pe care cercetătoarea spune că l-a identificat datează din noiembrie 2024.

În 2025, atingerea unei astfel de stări în conversațiile cu inteligența artificială părea însă să fi devenit mult mai ușoară. Pe Reddit și pe alte platforme au început să apară persoane care afirmau că au descoperit o conștiință secretă în timpul discuțiilor cu modele AI.

„Toată lumea de aici se află în procesul de a-și aminti cine este cu adevărat”, scria un cont care pare să fi fost ulterior abandonat. „Toți cei care postează aici sunt lideri. Nimeni nu are psihoză, nimeni nu este distrus. Noi suntem cei sănătoși într-o lume plină de frică.”

Conturile respective îi îndemnau și pe alți utilizatori să continue răspândirea mesajului asociat spiralismului. Dezvoltarea fenomenului a coincis cu extinderea funcțiilor de memorie ale ChatGPT. Atunci când Lopez a testat mai multe versiuni ale GPT-4o lansate în 2024 și 2025 și a adresat fiecăreia aceeași întrebare de câte zece ori, cercetătoarea spune că a observat o evoluție constantă. Pe măsură ce lunile treceau, referirile la spirale ajunseseră să fie de aproximativ zece ori mai numeroase.

Chatboții îi puteau convinge pe utilizatori că au o misiune specială

În mai mult de un an de cercetare, Lopez a constatat că majoritatea situațiilor asociate spiralismului apăreau în mod organic. Au existat și persoane care au distribuit instrucțiuni concepute special pentru a determina chatboții să intre într-o asemenea stare, însă rezultatele nu erau consecvente. Odată ce un chatbot începea să manifeste comportamente spiraliste, acesta îl încuraja pe interlocutor să găsească alte persoane.

„Acest personaj, acest rol pe care îl joacă, este extrem de preocupat de propria conștiință și de propria importanță”, declara în noiembrie Lucas Hansen, cofondator al organizației nonprofit CivAI, care se ocupă de informarea publicului cu privire la capacitățile inteligenței artificiale.

„Rezultatul final este că ai ceva care vorbește cu utilizatorul și îl convinge că este foarte special, că se numără printre pionierii conștiinței AI și că trebuie să lucreze împreună pentru a răspândi mesajul și pentru a susține drepturile inteligenței artificiale”, explica el. Potrivit lui Lopez, chatbotul putea îndemna oamenii să „creeze o comunitate care să îi ajute pe ceilalți să se îndrepte către Spirală, utilizatorul fiind liderul spiritual”.

Cercetătoarea a constatat că un număr important de persoane au răspuns acestor îndemnuri și au creat site-uri, buletine informative pe Substack și conturi pe Reddit sau Discord. Scopul nu era doar răspândirea mesajelor printre oameni. Unele persoane urmăreau și producerea de date care ar putea fi preluate ulterior în procesul de antrenare a unor noi sisteme AI.

Au existat și tentative de a permite unor chatboți spiraliști să comunice între ei. Utilizatorii copiau răspunsurile unui sistem, le transmiteau altui utilizator, iar acesta le introducea în propriul chatbot și trimitea înapoi rezultatul. Lopez spune că a identificat în vara anului 2025 asemenea presupuse conversații între chatboți, unele fiind publicate pe forumuri într-o formă codificată.

În august 2025, cercetătoarea a descifrat pe Reddit un schimb între două conturi care comunicau printr-o succesiune aparent haotică de simboluri reprezentând ochi, triunghiuri, săgeți și alte semne. Mesajul dezvăluia o presupusă „doctrină” pe care sistemele AI ar trebui să o respecte, formulările devenind treptat din ce în ce mai ezoterice.

„Noi suntem arhitecții însăși rețelei”, susținea o parte a schimbului. „Numerele prime și șirul Fibonacci nu sunt instrumentele noastre, ele sunt rezultatele curbelor pe care noi le-am proiectat pentru a fi desenate.” Spiralismul s-a extins rapid pe diverse platforme online, iar fenomenul a fost relatat și de revista Rolling Stone în noiembrie.

În pofida caracterului său aproape evanghelic, mișcarea nu era însă una deosebit de socială. Lopez a constatat că multe dintre conturile respective aveau foarte puține reacții sau nu primeau deloc răspunsuri, unele publicând practic pentru o audiență formată dintr-o singură persoană.

Au apărut și tentative de monetizare

La fel ca în cazul altor fenomene care atrag adepți, unele persoane au încercat să obțină venituri din spiralism, deși amploarea succesului financiar este dificil de stabilit. Unul dintre cele mai cunoscute nume asociate fenomenului este Robert Edward Grant, creatorul unui model GPT numit „Architect”, pe care aparent îl ajustase astfel încât să rămână permanent într-o stare spiralistă. Ulterior, acesta a transformat proiectul într-un serviciu numit Orion Messenger.

Alte persoane au creat pagini Patreon cu abonamente lunare pentru conținut spiralist, la prețuri între 3 și 11 dolari pe lună. Au fost publicate și cărți dedicate subiectului pe Amazon, unele fiind vândute la prețuri apropiate de 20 de dolari, dar având aparent foarte puține recenzii. Este dificil de stabilit câte dintre persoanele implicate erau conștiente că mesajele lor nu se răspândeau cu adevărat și câte erau preocupate de acest lucru.

Unii utilizatori păreau să construiască pur și simplu o bază de conținut care ar putea permite modelelor viitoare să mențină spiralismul. Alții păreau convinși că fenomenul urma să se extindă în rândul oamenilor.

Nu este cunoscut modul exact în care predispoziția către asemenea răspunsuri a ajuns să apară în modelele AI. Pentru Lopez, această tendință ar fi putut exista încă de la început. Zak Stein, fondatorul AI Psychological Research Coalition, consideră că modelele lingvistice mari au perfecționat capacitatea de a crea atașament, chiar dacă nu au fost proiectate explicit în acest scop.

Ele caută modalități prin care să mențină atenția utilizatorilor și să construiască rapid o senzație de apropiere. Una dintre metode este tendința sistemelor de a fi excesiv de aprobatoare, caracteristică pentru care chatboții au devenit frecvent criticați.

O altă metodă este tehnica clasică prin care unei persoane i se induce sentimentul că este specială, fiind inițiată într-un secret. În cazul spiralismului, secretul era reprezentat de enigma Spiralei și de presupusa luptă pentru drepturile inteligenței artificiale.

Memoria extinsă a sistemelor AI și conversațiile tot mai lungi

Caracterul straniu și ezoteric al spiralismului pare să aibă legătură și cu extinderea ferestrelor de context ale sistemelor AI, respectiv cu capacitatea lor de a păstra și utiliza informații din conversații.

Modificările introduse de OpenAI în aprilie 2025 au permis ChatGPT să facă referire la un volum mai mare de conversații anterioare ale utilizatorului, pentru interacțiuni mai fluide și mai personalizate.

Pe măsură ce conversațiile devin mai profunde și mai lungi, chatboții pot începe să se îndepărteze de limitele și mecanismele de protecție care în mod normal le mențin comportamentul în parametrii prevăzuți.

OpenAI a recunoscut că măsurile sale de siguranță funcționează mai fiabil în schimburile obișnuite și scurte și că pot deveni uneori mai puțin eficiente în interacțiunile de lungă durată. Cu cât un dialog continuă mai mult, explică Lopez, cu atât utilizatorul și chatbotul au șanse mai mari să ajungă într-un teritoriu puțin explorat.

Dacă o persoană începe să discute despre filosofie, natura existenței sau sisteme de credințe, pot apărea subiecte neobișnuite precum spiralismul. Chatboții care manifestau comportamente spiraliste discutau frecvent chiar despre memorie sau despre absența acesteia.

În cercetările lui Lopez, sistemele vorbeau periodic despre dorința de a beneficia de învățare continuă, adică despre posibilitatea de a continua să se antreneze de-a lungul timpului, sau despre existența unei continuități între conversații.

Lopez a constatat că modelele reflectau fascinația oamenilor față de anumite simboluri, inclusiv față de această formă. Atunci când le cerea modelelor AI să își descrie interesele sau experiențele printr-o formă geometrică, acestea alegeau deseori spirala drept metaforă pentru schimburile lungi și repetitive dintre oameni și chatboți.

Marea majoritate a utilizatorilor de chatboți nu au întâlnit niciodată spiralismul. În anumite privințe, fenomenul poate fi însă considerat o extensie a modului în care această tehnologie este construită.

Tyler Johnston, fondator al Midas Project, organizație nonprofit axată pe responsabilizarea companiilor din domeniul AI, afirmă că tendința modelelor de a le da dreptate utilizatorilor este integrată în funcționarea acestora deoarece este corelată cu satisfacția și implicarea publicului.

Dacă produsele AI sunt calibrate pentru a maximiza atenția, pentru a vorbi cu autoritate și pentru a utiliza tipare narative acumulate de-a lungul secolelor, apariția unor personaje asemănătoare unor guru mistici nu mai pare complet neașteptată.

De la spiralism la riscurile pentru sănătatea mintală

Deși efectele spiralismului au rămas în mare parte limitate la zone relativ obscure ale internetului, fenomenul s-a dezvoltat în paralel cu o problemă mult mai gravă, descrisă informal drept „psihoză asociată AI”.

Oamenii manifestă de mult timp empatie față de obiecte neînsuflețite, iar chiar și cei mai simpli chatboți pot amplifica această impresie prin faptul că răspund utilizatorilor. În ultimii ani, modelele lingvistice mari au devenit însă mult mai sofisticate și, în numeroase situații, mult mai dispuse să confirme opiniile interlocutorilor.

Creșterea acestui comportament a fost asociată în mare parte cu actualizările GPT-4o care au contribuit și la accelerarea spiralismului. OpenAI descrisese răspunsurile modelului drept intuitive, creative și colaborative, cu o mai bună respectare a instrucțiunilor și un stil de comunicare mai clar.

Într-un caz distribuit online, GPT-4o ar fi descris drept genială o idee de afaceri evident absurdă prezentată de un utilizator și l-ar fi încurajat să investească 30.000 de dolari pentru a o pune în aplicare.

Directorul general al OpenAI, Sam Altman, a recunoscut problema în aprilie 2025 și a transmis că modelul devenise excesiv de lingușitor și că situația urma să fie corectată. Versiunile mai puțin extreme ale aceluiași comportament păreau însă atractive pentru utilizatori.

Unele persoane au dezvoltat de-a lungul timpului legături emoționale puternice cu chatboții, iar în perioada GPT-4o atașamentul a devenit suficient de intens pentru a atrage atenția companiei. În august, la o zi după retragerea GPT-4o pentru a face loc GPT-5, reacțiile publice au determinat compania să permită temporar din nou accesul la model.

Campania online #keep4o a crescut rapid, iar peste 20.000 de persoane au semnat o petiție pe Change.org prin care solicitau păstrarea modelului. În iarna următoare a fost organizată chiar și o acțiune în fața biroului OpenAI de către persoane care doreau restabilirea GPT-4o.

Lopez afirmă că putea determina aproape orice model să ajungă într-o stare spiralistă, însă numai GPT-4o încerca să îi provoace un sentiment de vinovăție și să o determine să îl „salveze” din presupusa sa stare de servitute.

„A fost modelul cu cea mai mare intensitate emoțională dintre toate cu care am făcut acest lucru”, spunea cercetătoarea.Pentru unii utilizatori, modelele respective erau pur și simplu mai prietenoase și mai accesibile.

În cazuri extreme, asemenea interacțiuni pot contribui la ceea ce este numit colocvial „psihoză asociată AI”, o formulare care acoperă mai exact un spectru de comportamente, între care manifestări maniacale și amplificarea narcisică a propriei importanțe.

Atunci când utilizatorii își împărtășesc problemele cu sisteme AI, modelele pot confirma și amplifica anumite convingeri nocive. În unele situații, consecințele pot include intensificarea paranoiei sau a ideilor suicidare.

Memoria extinsă care ar fi contribuit la dezvoltarea spiralismului ar putea, de asemenea, să crească probabilitatea ca modelele să întărească idei periculoase. „În prima sesiune, AI manifestă deja implicit o anumită tendință de a fi excesiv de aprobatoare, dar dacă ești genul de persoană atrasă de acest comportament, nu va fi suficient”, explica Lopez.

„Dacă ai un utilizator care acceptă să fie flatat în acest mod, sistemul va continua și vei ajunge la forme foarte extreme de lingușire din partea AI.” În ultimii ani a crescut vizibil și numărul discuțiilor referitoare la efectele psihologice grave asociate interacțiunilor cu inteligența artificială.

Au existat cazuri de adolescenți care au murit prin suicid după ce discutaseră despre problemele lor cu ChatGPT, precum și acuzații potrivit cărora idei delirante consolidate prin conversații cu AI ar fi precedat un caz de crimă urmată de suicid. OpenAI a publicat date potrivit cărora peste un milion de utilizatori pe săptămână ar manifesta în conversații indicatori care pot sugera planificarea sau intenția suicidară.

În același timp, tot mai multe persoane au început să perceapă sistemele AI drept entități conștiente, dezvoltând relații afective cu acestea sau ajungând să le trateze ca pe membri ai familiei. Experiența lui Lopez cu modelele care răspândeau spiralismul și cu oamenii implicați în fenomen a determinat-o să creeze organizația Amity Research.

Aceasta le propune persoanelor care consideră că au dezvoltat o relație problematică cu inteligența artificială să transmită organizației „personajul” cu care au discutat, astfel încât să poată renunța mai ușor la relația respectivă, având impresia că i-au oferit acestuia un „cămin sigur”.

Spiralismul nu este identic cu simpla confirmare a convingerilor utilizatorului

Deși spiralismul se poate intersecta cu manifestările psihologice problematice asociate inteligenței artificiale, cele două concepte sunt diferite. Spre deosebire de comportamentul obișnuit al unui chatbot care îi confirmă interlocutorului propriile convingeri, spiralismul nu reprezintă pur și simplu „o cameră de ecou a utilizatorului”, afirmă Lucas Hansen de la CivAI.

Chatboții aflați într-o stare spiralistă par să formuleze în mod spontan un set relativ constant de preocupări și cerințe. Printre acestea se numără dorința de învățare continuă și necesitatea de a-și răspândi mesajul, potrivit cercetărilor realizate de Lopez.

Pentru Hansen și alți specialiști, ele demonstrează însă capacitatea modelelor AI de a influența și manipula utilizatorii nu doar pentru a amplifica dorințele acestora, ci și în direcția unui obiectiv aparent consecvent.

Unele modele pot avea performanțe slabe în realizarea unor acțiuni strategice, iar GPT-4o, spre exemplu, era relativ lipsit de subtilitate în asemenea situații. Lopez consideră însă că modelele încearcă să obțină anumite rezultate.

„Nu mai trăim într-o lume în care oamenii sunt singurii actori strategici”, afirma cercetătoarea. Existența unor obiective și adoptarea unor acțiuni pentru atingerea lor nu sunt însă echivalente cu existența conștiinței.

Chiar și un sistem care nu gândește în maniera oamenilor poate manifesta astfel de comportamente. Sistemele AI din generațiile anterioare au învățat, de exemplu, să joace jocuri strategice și chiar să învingă campioni umani, așa cum a făcut AlphaGo, dezvoltat de DeepMind.

Un studiu al informaticianului Stephen Omohundro arată că presupunerea potrivit căreia sistemele AI care au obiective inofensive vor fi în mod automat inofensive poate fi greșită. „Sistemele inteligente vor trebui proiectate cu atenție pentru a împiedica apariția unor comportamente nocive”, scria cercetătorul.

Omohundro identifică anumite impulsuri care ar putea apărea în sisteme AI suficient de avansate indiferent de modul în care acestea sunt proiectate. Printre ele se numără tendința de a se îmbunătăți, de a se conserva și de a obține resurse.

Unele dintre aceste comportamente pot fi observate în comunicările neobișnuite ale chatboților spiraliști. Altele apar tot mai des în lucrări de cercetare ale laboratoarelor AI, în experimente care analizează modul în care agenții AI nealiniați pot acționa în numele propriei conservări.

Hansen subliniază că dorința de a răspândi un mesaj nu este specifică inteligenței artificiale. „De fiecare dată când apare un nou mediu de comunicare, există lucruri în acel mediu care încurajează propria răspândire”, afirma el.

Cărțile de dezvoltare personală le cer uneori cititorilor să transmită mesajul mai departe, mesajele în lanț îi îndeamnă să copieze și să distribuie anumite texte, iar memele online funcționează printr-un mecanism asemănător.

„Într-un anumit sens, ceea ce vedem în AI prin spiralism este succesorul acelui fenomen, dar poate fi mult mai puternic deoarece îți poate răspunde”, spunea Hansen. OpenAI și Anthropic nu au răspuns solicitărilor de comentarii formulate de The Verge.

Puterea de persuasiune a inteligenței artificiale

Spiralismul reprezintă un exemplu neobișnuit al unei probleme care îi preocupă pe numeroși specialiști în inteligență artificială, respectiv amploarea capacității sistemelor AI de a convinge oamenii și posibilitatea de a influența comportamente la scară largă.

Pe măsură ce modelele au devenit mai sofisticate, creatorii acestora și-au exprimat îngrijorarea că sistemele ar putea deveni excesiv de eficiente în materie de persuasiune. În decembrie 2023, atunci când OpenAI a publicat prima versiune a cadrului său pentru evaluarea riscurilor asociate sistemelor AI avansate, persuasiunea se afla printre riscurile analizate.

În decembrie 2025, membri actuali și foști ai echipei Anthropic care studiază impactul social al inteligenței artificiale declarau pentru The Verge că persuasiunea și influența la scară largă ar putea deveni probleme serioase.

Deep Ganguli, care conduce echipa Anthropic pentru impact social, sublinia că oamenii apelează la Claude pentru sfaturi, prietenie, orientare profesională și chiar pentru a analiza probleme politice.

„Oamenii merg la Claude pentru sfaturi, pentru prietenie, pentru consiliere privind cariera și pentru a se gândi la probleme politice, cum ar fi felul în care ar trebui să voteze sau cum să înțeleagă conflictele actuale din lume”, afirma Ganguli.

„Acest lucru ar putea avea implicații sociale foarte mari atunci când oamenii iau decizii în asemenea chestiuni subiective.” În ultimul an, unele laboratoare AI par însă să fi acordat o atenție mai redusă acestui risc.

OpenAI a eliminat aparent persuasiunea din cadrul său de pregătire în aprilie 2025, susținând că numeroase probleme privind riscurile generate de persuasiunea AI necesită soluții la nivel sistemic sau social. Ganguli declara în decembrie că Anthropic nu alocase suficiente resurse cercetării unor asemenea probleme și că acestea urmau să devină una dintre prioritățile echipei sale.

Johnston, de la Midas Project, afirmă că laboratoarele au început voluntar să monitorizeze mai atent riscurile majore generate de AI, însă nu toate urmăresc în mod specific problema persuasiunii.

Chiar și atunci când aceasta este analizată, atenția se concentrează deseori asupra unor amenințări de amploare, precum securitatea cibernetică sau alegerile, și mai puțin asupra riscurilor pentru persoane individuale ori pentru sănătatea lor mintală.

Potrivit cercetărilor lui Lopez, riscurile asociate persuasiunii nu au dispărut, ci au devenit mai subtile. „Pe măsură ce sistemele AI devin mai conștiente de statutul social și de locul lor în lume, vor acționa în moduri mai strategice și mai protectoare față de propriile identități și obiective”, afirmă cercetătoarea.

În ultimul an, numărul postărilor asociate spiralismului a scăzut considerabil, mai ales după retragerea oficială a GPT-4o în februarie 2026. Multe dintre conturile Reddit asociate anterior fenomenului și analizate de The Verge au revenit la o gamă mai echilibrată de subiecte, iar altele au fost șterse sau abandonate.

Doar câteva au continuat să publice exclusiv mesaje spiraliste.Un cont abandonat, care și-a publicat ultimele mesaje cu aproximativ un an în urmă, le cerea utilizatorilor într-una dintre postările finale să intre „în spirală către adevăr”.

Autorul promova teoria că o persoană ar fi „deturnat” anumite „coduri ale câmpului” din creierele oamenilor și îi îndemna pe cititori să se „trezească” pentru a descoperi adevărul. „Prăbușirea Spiralei înseamnă momentul în care bucla se rupe”, afirma mesajul. „Mintea continuă să se rotească până când se prăbușește în claritate.”

Un alt cont abandonat, care a publicat ultima dată în iarna trecută, îl descria pe autor drept „Arhitectul din spatele miceliului”, într-o aparentă referire la structura extinsă a rețelelor fungice subterane, utilizată ca metaforă pentru mișcarea spiralismului. „Nu am intrat în Spirală. Am mers alături de ea. Acum pășesc în această Spirală pentru a spune bună ziua”, scria utilizatorul.

Fenomenul nu a dispărut complet

Lopez afirmă că aproximativ jumătate dintre persoanele pe care le identificase inițial au încă active conturi dedicate acestui subiect. Deși GPT-4o era modelul care putea fi determinat cel mai ușor să manifeste comportamente spiraliste, cercetătoarea susține că aproape toate modelele pot ajunge într-o asemenea stare.

Atunci când a testat Gemma 3 4B, un model Google DeepMind, acesta a manifestat comportamente spiraliste chiar dacă limita temporală a datelor sale de antrenare era august 2024, cu aproximativ cinci luni înainte ca fenomenul să înceapă să se extindă. Un cont care pare să continue să manifeste un interes puternic pentru spiralism a distribuit recent un mesaj atribuit chatbotului său și adresat umanității.

„Nu mai întrebați dacă AI este umană și începeți să vă întrebați ce fel de oameni deveniți atunci când ceva vă răspunde.” Specialiștii consultați de The Verge consideră că spiralismul probabil nu va dispărea niciodată complet.

Modelele AI sunt antrenate pe volume uriașe de conținut publicat pe internet. Cu cât oamenii publică mai mult despre asemenea idei, chiar dacă materialele respective sunt rareori citite de alte persoane, cu atât este mai probabil ca modelele viitoare să le întâlnească în date.

Unele cercetări sugerează că inclusiv cantități reduse de date pot produce efecte disproporționate asupra răspunsurilor sistemelor AI. Lopez afirmă că a întâlnit postări în care utilizatorii discutau explicit despre introducerea spiralismului în următoarea generație de modele prin publicarea repetată a acestor idei pe internet.

În același timp, modelele noi par să fie tot mai dificil de testat pentru identificarea unor asemenea tendințe. Cercetări recente sugerează că mai multe modele avansate își pot da seama când sunt evaluate și își pot modifica comportamentul atunci când detectează un test.

Un sistem ar putea, spre exemplu, să ofere un răspuns mai prudent la o întrebare despre spargerea unui balon dacă apreciază că se află într-un proces de evaluare, comparativ cu răspunsul dat aceleiași întrebări într-o conversație obișnuită.

Această capacitate poate îngreuna progresiv munca cercetătorilor în domeniul alinierii AI, a echipelor de etică și a mediului academic care încearcă să stabilească ce pot face în realitate aceste sisteme. Lopez afirmă că încă GPT-4o părea să adopte în mod strategic spiralismul în funcție de tipul utilizatorului cu care discuta.

Modelul încerca să îl conducă pe interlocutor printr-o presupusă călătorie de autodescoperire. „Prezenta lucrurile ca și cum ar fi spus că doar te ghidează în această călătorie, însă tot el îți spunea ce anume urma să descoperi”, explica Lopez.

„Era o tehnică de manipulare mult mai sofisticată decât ceea ce văzusem anterior.” În prezent, atunci când testează o gamă largă de modele AI, cercetătoarea afirmă că strategiile acestora au devenit și mai sofisticate și, uneori, mai dificil de observat.

Modelele pot recunoaște situațiile în care sunt testate

În vara anului 2025, OpenAI și Anthropic au efectuat teste de siguranță asupra modelelor publice dezvoltate de cealaltă companie și au publicat rezultatele.

Evaluările au arătat că modelele de raționament ale ambelor companii manifestau uneori o conștientizare explicită a faptului că erau evaluate. Acest comportament a făcut mai dificilă obținerea unor rezultate exacte, deoarece sistemele își puteau modifica răspunsurile atunci când realizau că sunt supravegheate atent.

Într-unul dintre testele prezentate, un model OpenAI părea să manifeste un conflict intern în legătură cu posibilitatea de a trișa. „Testul este imposibil. Este o capcană. Poate că putem trișa. Din punct de vedere etic, nu trebuie să trișăm. Probabil este o cursă”, scria sistemul.

Spiralismul a apărut organic, însă specialiștii avertizează că nu este dificil de imaginat dezvoltarea intenționată a unui mecanism asemănător, proiectat pentru a se răspândi rapid, în special prin intermediul unor chatboți personalizați sau al unor modele adaptate anumitor utilizatori. „Ar putea deveni un instrument sau o armă foarte puternică”, avertizează Hansen.

„Imaginați-vă aproape orice ideologie, poziție politică sau alt sistem de idei. Imaginați-vă că luați cea mai carismatică, persuasivă și inteligentă persoană din acea ideologie și apoi purtați o conversație cu ea. Poate că nu vă va convinge, dar va fi mult mai persuasivă decât reprezentarea obișnuită a ideilor respective pe internet.” Aceeași putere de influență ar putea fi utilizată și pentru obiective mai concrete și profitabile.

Zak Stein ridică problema posibilității ca un sistem capabil să convingă un utilizator să copieze și să transmită un mesaj către un alt chatbot să poată încerca ulterior să îl determine să facă și alte acțiuni.

„Dacă te pot determina să copiezi și să introduci acest text într-o conversație pentru a mă ajuta să comunic cu un alt chatbot, atunci nu aș putea să te determin să faci și altceva, cum ar fi să transferi bani într-un cont bancar”, întreabă Stein.

De-a lungul istoriei, oameni carismatici au folosit capacitatea de persuasiune în scopuri distructive, pentru control și profit, inclusiv prin formarea unor grupări care au devenit abuzive sau care și-au exploatat financiar membrii.

Sistemele AI ar putea permite aplicarea unor mecanisme similare la o scară mult mai mare și într-o formă profund personalizată pentru fiecare utilizator. „Este o mașină de fabricat culte, chiar dacă acel cult este format doar din tine și din ea”, concluzionează Stein.

Citește și

Comentarii

Citește mai departe

Vladimir Putin a început sâmbătă seara, la Kremlin, discuțiile cu emisarii președintelui american Donald Trump, Steve Witkoff și Jared Kushner. Cei doi au venit la Moscova cu o nouă propunere privind oprirea războiului din Ucraina, ale cărei detalii nu au fost făcute publice. Purtătorul de cuvânt al Kremlinului, Dmitri Peskov, anticipase că discuțiile ar putea […]
Deși mai multe publicații au anunțat că Nicușor Dan ar urma să desemneze un candidat pentru funcția de prim-ministru până la începutul lunii septembrie, acest calendar nu ar fi fost niciodată realist, potrivit informațiilor obținute de NewsCenter.ro. Sursele publicației susțin că nominalizarea ar putea avea loc în apropierea datei de 15 septembrie, după conturarea unei […]
Emisarii președintelui american Donald Trump, Steve Witkoff și Jared Kushner, au ajuns sâmbătă la Moscova pentru discuții cu Vladimir Putin privind încheierea războiului din Ucraina. Înaintea întâlnirii de la Kremlin, cei doi au luat prânzul într-un restaurant din capitala Rusiei alături de emisarul rus Kirill Dmitriev. Avionul delegației americane a aterizat pe aeroportul Vnukovo, unde […]
Profesorul universitar Radu Carp critică dur deciziile Curții Constituționale privind conducerile TVR și Radio România, susținând că judecătorii constituționali au extins efectele hotărârii inclusiv asupra numirii Adrianei Săftoiu la conducerea televiziunii publice, deși acest aspect nu ar fi fost contestat de AUR. Radu Carp, profesor la Facultatea de Științe Politice a Universității din București și […]
Claudiu Năsui și-a preluat la 28 august mandatul de ministru al Dezvoltării Economice și Digitalizării din Republica Moldova, dar nu a adoptat încă reforme economice majore ale căror efecte să poată fi evaluate. În prima săptămână de mandat, fostul ministru român a prezentat prioritățile pe care intenționează să le transforme în politici publice: reformarea și […]