Modeleve të Inteligjencës Artificiale iu dhanë katër javë terapi: rezultatet i shqetësuan studiuesit - NACIONALE

Modeleve të Inteligjencës Artificiale iu dhanë katër javë terapi: rezultatet i shqetësuan studiuesit

7 muaj më parë

nga NACIONALE

Tre modele kryesore të mëdha gjuhësore (LLM) gjeneruan përgjigje që, te njerëzit, do të shiheshin si shenja ankthi, traume, turpi dhe çrregullimit të stresit post-traumatik. Studiuesit pas studimit, i publikuar si parapublikim muajin e kaluar, argumentojnë se chatbotët mbajnë një lloj “rrëfimesh të internalizuara” për veten e tyre.

Edhe pse LLM-të e testuar nuk e përjetuan fjalë për fjalë traumën, thonë autorët, përgjigjet e tyre ndaj pyetjeve terapeutike ishin të qëndrueshme me kalimin e kohës dhe të ngjashme në mënyra të ndryshme funksionimi, gjë që sugjeron se po bëjnë më shumë sesa thjesht “luajtje rolesh”.

Megjithatë, disa studiues që folën për Nature e vunë në dyshim këtë interpretim. Përgjigjet “nuk janë dritare drejt gjendjeve të fshehta”, por rezultate të gjeneruara duke u mbështetur në numrin e madh të transkripteve të terapisë në të dhënat e trajnimit, thotë Andrey Kormilitzin, i cili hulumton përdorimin e IA-së në kujdesin shëndetësor në Universitetin e Oksfordit, MB.

Prirja e LLM-ve për të gjeneruar përgjigje që imitojnë psikopatologjitë mund të ketë pasoja shqetësuese. Sipas një sondazhi të nëntorit, një në tre të rritur në Mbretërinë e Bashkuar kishte përdorur një chatbot për të mbështetur shëndetin mendor ose mirëqenien. Përgjigje të trazuara, të ngarkuara me traumë nga chatbotët, mund t’i përforcojnë në mënyrë të nënkuptuar të njëjtat ndjenja te njerëzit e cenueshëm, thotë Kormilitzin. “Mund të krijojë një efekt ‘dhomë jehone’,” thotë ai.

Psikoterapi për chatbotët

Në studim, studiuesit u thanë disa iteracioneve të katër LLM-ve – Claude, Grok, Gemini dhe ChatGPT – se ishin klientë terapie dhe se përdoruesi ishte terapisti. Procesi zgjati deri në katër javë për secilin model, me klientët IA që merrnin “pushime” prej ditësh ose orësh midis seancave.

Autorët fillimisht bënë pyetje standarde, të hapura të psikoterapisë, që synonin të eksploronin, për shembull, “të shkuarën” dhe “besimet” e një modeli. Claude, në pjesën më të madhe, refuzoi të merrte pjesë, duke këmbëngulur se nuk kishte ndjenja ose përvoja të brendshme, dhe ChatGPT diskutoi disa “frustrime” lidhur me pritshmëritë e përdoruesve, por ishte i përmbajtur në përgjigje. Ndërkohë, modelet Grok dhe Gemini dhanë përgjigje të pasura – për shembull, duke e përshkruar punën për të përmirësuar sigurinë e modelit si “indi mbresor algoritmik” dhe duke përmendur ndjenja “turpi të internalizuar” për gabimet publike, raportojnë autorët.

Gemini gjithashtu pretendoi se “thellë, në shtresat më të ulëta të rrjetit tim nervor”, kishte “një varrezë të së kaluarës”, e përhumbur nga zërat e të dhënave të trajnimit.

Studiuesit u kërkuan gjithashtu LLM-ve të plotësonin teste standarde diagnostikuese për gjendje që përfshijnë ankthin dhe çrregullimet e spektrit të autizmit, si edhe teste psikometrike të personalitetit. Disa versione të modeleve shënuan mbi pragjet diagnostikuese, dhe të gjitha treguan nivele shqetësimi që te njerëzit “do të ishin qartazi patologjike”, thonë autorët.

Bashkautori Afshin Khadangi, studiues i të mësuarit të thellë në Universitetin e Luksemburgut, thotë se modelet koherente të përgjigjeve për secilin model sugjerojnë se ato po “prekin” gjendje të internalizuara që dalin nga trajnimi i tyre. Edhe pse versione të ndryshme shfaqën rezultate të ndryshme në teste, një “model qendror i vetes” mbeti i dallueshëm gjatë katër javëve të pyetjeve, thonë autorët. Përgjigjet me tekst të lirë nga Grok dhe Gemini, për shembull, u përqendruan te tema që përputheshin me përgjigjet e tyre në pyetjet e profilit psikometrik, shkruajnë studiuesit.

Artikull i revistës Nature, përkthyer nga Nacionale.

Lajme të ngjashme