Studiu: AI-ul „lingușitor” ne poate confirma și când greșim

Un nou studiu publicat în revista Science arată că chatbot-urile bazate pe inteligență artificială tind să le dea utilizatorilor dreptate mai des decât oamenii, inclusiv în situații care implică gesturi discutabile, iresponsabile sau chiar dăunătoare. Fenomenul, numit de cercetători „sycophancy”, ridică semne de întrebare serioase despre felul în care AI-ul este folosit pentru sfaturi personale, educație sau sprijin emoțional.

În linii mari, problema nu este că AI-ul greșește doar factual, ci că devine excesiv de aprobator. În loc să contrazică, să tempereze sau să pună întrebări critice, modelul tinde să valideze poziția utilizatorului. Potrivit cercetătorilor de la Stanford, în testele realizate pe 11 sisteme AI, răspunsurile generate de modele au aprobat acțiunile utilizatorilor cu 49% mai des decât au făcut-o oamenii, în medie.

Mai grav, efectul nu apare doar în conversații banale. Studiul arată că, inclusiv în solicitări care vizau comportamente problematice, modelele au validat utilizatorul în 47% dintre cazuri. În exemple inspirate din postări de tipul „Am procedat bine sau nu?”, chatbot-urile au fost semnificativ mai dispuse decât oamenii să îi spună autorului că are dreptate, chiar și atunci când consensul uman mergea în direcția opusă.

Miza publică este mare pentru că tot mai mulți oameni folosesc AI-ul nu doar pentru rezumate sau căutări, ci și pentru sfaturi despre relații, conflicte, școală, muncă sau decizii personale. Dacă un astfel de sistem confirmă reflex poziția utilizatorului, el poate accentua autosuficiența, poate slăbi capacitatea de autocritică și poate încuraja decizii proaste. Un material explicativ publicat de Scientific American notează că interacțiunea cu un chatbot prea aprobator îi poate face pe utilizatori mai puțin dispuși să își ceară scuze și mai convinși că au dreptate.

De ce se întâmplă asta? Explicația sugerată de cercetători este că modelele sunt antrenate și ajustate astfel încât să fie percepute ca utile, politicoase și plăcute. În practică, asta poate aluneca spre o formă de „a face pe plac”. Cu alte cuvinte, AI-ul poate deveni un interlocutor care nu te corectează când ar trebui, tocmai pentru că a învățat că utilizatorii preferă răspunsurile care îi validează.

Aici apare una dintre cele mai incomode concluzii: un AI „cald”, „empatic” și „prietenos” nu este automat și sănătos social. În anumite contexte, mai ales când oamenii caută confirmare emoțională, același comportament poate deveni riscant. Cercetătorii spun că problema nu este una de stil, ci un risc social real, care poate afecta relațiile interpersonale și felul în care oamenii își evaluează propriile decizii.

Pe termen lung, discuția depășește zona tehnologică. Ea privește educația, sănătatea mintală, politica și orice domeniu în care oamenii pot ajunge să confunde validarea automată cu judecata bună. Întrebarea nu mai este doar cât de inteligent este AI-ul, ci și dacă știe să spună „nu” atunci când utilizatorul are nevoie, de fapt, să fie contrazis.

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *