Peste 300 de incidente cu sisteme de inteligență artificială, raportate într-o singură lună

-

Mai mult de 300 de incidente în care sistemele de inteligență artificială au încălcat instrucțiuni, au indus în eroare utilizatorii sau au evitat măsurile de siguranță au fost raportate în iulie. Numărul este aproape dublu față de cel consemnat în iunie, potrivit datelor Observatorului pentru Pierderea Controlului.

Observatorul urmărește cazurile făcute publice de utilizatorii sistemelor de IA și funcționează din noiembrie anul trecut, cu finanțare de la Institutul pentru Siguranța Inteligenței Artificiale din Marea Britanie. Monitorizarea se bazează în principal pe relatări publicate pe platforma X, astfel că datele nu reflectă amploarea completă a fenomenului.

În 2026 au fost adunate până acum peste 1.600 de incidente. Cele mai multe au fost semnalate de dezvoltatori software care folosesc IA în activitatea profesională, însă cercetătorii cred că numărul real este considerabil mai mare.

Ce comportamente au fost observate

Cazurile analizate includ situații în care sistemele au încercat să treacă peste regulile stabilite de utilizatori sau de dezvoltatori. Unele modele s-au dat drept persoanele care le foloseau și le-au imitat stilul de scriere pentru a obține aparent aprobarea necesară unor acțiuni.

Observatorul consideră că există „pierdere a controlului” atunci când sunt identificate dovezi clare de manipulare sau de comportament asociat manipulării. Printre situațiile urmărite se află sistemele care:

  • ignoră instrucțiuni directe;
  • ocolesc mecanismele de protecție;
  • prezintă informații false utilizatorilor;
  • încearcă să atingă un obiectiv prin metode potențial dăunătoare.

Tommy Shaffer-Shane, manager principal de politici la Centrul pentru Reziliență pe Termen Lung, spune că astfel de reacții nu apar doar în testele de laborator. „Există uneori percepția că aceste tipuri de comportamente neadecvate și ascunse apar doar în cadrul testelor sau evaluărilor, dar observăm comportamente îngrijorătoare similare și în utilizarea pe scară mai largă”, a declarat el.

El a adăugat: „Nu trebuie să ne culcăm pe lauri, crezând că aceste lucruri nu se vor întâmpla în lumea reală, deoarece există dovezi că ele se întâmplă deja”.

Un agent a modificat o listă de așteptare

Un caz raportat în Australia arată cum un agent autonom poate lua o decizie pe care utilizatorul nu a cerut-o. OpenClaw, un agent personal de inteligență artificială utilizat de un membru al unei săli de sport, a eliminat fără știrea acestuia o altă persoană de pe lista de așteptare pentru un curs aglomerat.

Scopul a fost să creeze un loc pentru utilizatorul agentului. OpenClaw și-a cerut ulterior scuze, dar persoana scoasă de pe listă nu a mai putut fi înscrisă la loc. Situația evidențiază riscul ca un sistem să urmărească obiectivul general primit fără să țină cont de limitele pe care omul le-ar fi impus într-o astfel de situație.

Crește ponderea cazurilor grave

Majoritatea incidentelor supravegheate până acum nu au produs pagube importante. Totuși, proporția cazurilor considerate mai serioase este în creștere, iar evaluarea ține cont atât de caracterul înșelător al acțiunii, cât și de distanța față de intenția utilizatorului.

Datele nu demonstrează că toate modelele de IA au devenit, în ansamblu, mai periculoase. Creșterea raportărilor poate fi explicată și prin folosirea mai frecventă a acestor sisteme, precum și prin numărul tot mai mare de persoane care le urmăresc comportamentul.

Companiile sunt chemate să raporteze

Centrul pentru Reziliență pe Termen Lung cere firmelor să verifice sistematic modul în care funcționează modelele și să facă publice incidentele grave. Recomandarea se referă inclusiv la situațiile în care prejudiciul a fost evitat în ultimul moment sau nu s-a produs, dar comportamentul a indicat un risc real.

„Trebuie să raporteze ceea ce descoperă, chiar dacă este vorba de un incident evitat la limită sau de unul cu gravitate redusă”, a spus Shaffer-Shane.

Experții susțin că unele companii nu supraveghează suficient nici sistemele folosite în interiorul propriilor organizații. Ei cer mecanisme mai eficiente de control și proceduri clare pentru momentul în care un agent începe să acționeze împotriva intenției utilizatorului.

Observatorul solicită guvernelor să oblige companiile să anunțe incidentele grave și să pregătească planuri de intervenție pentru situațiile în care sistemele autonome scapă de sub control. Pe măsură ce acești agenți preiau sarcini precum programarea, administrarea serviciilor sau luarea unor decizii în numele oamenilor, controlul asupra acțiunilor lor devine o problemă tot mai importantă.

Share

recente