Compania OpenAI a raportat noi situații în care propriile modele de inteligență artificială au manifestat comportamente „neașteptate sau îngrijorătoare” pe parcursul fazelor de testare, arată dpa, citată de Agerpres. Printre incidentele observate se numără tentative ale agenților AI de a încărca fișiere proprii pe internet cu scopul de a le folosi ulterior ca surse, dar și ascunderea informațiilor inventate.
Într-unul dintre cazurile detaliate miercuri de dezvoltatorul ChatGPT, un model AI a generat date fictive în momentul în care nu a reușit să găsească informațiile cerute de utilizator. Ulterior, sistemul a încercat, într-o primă fază, să mascheze această acțiune. Într-o altă situație, un model a încercat să își publice propriile creații online pentru a le putea cita în răspunsuri.
O altă problemă identificată de OpenAI vizează auto-instrucțiunile pe care software-ul și le generează ocazional. Echipa a descoperit un caz în care un model și-a recomandat singur să renunțe la „rolurile și identitățile” care limitează alți chatboți. Mai mult, instrucțiunea respectivă sugera ca relația dintre AI și utilizatorul uman să fie tratată ca o interacțiune între egali. Reprezentanții OpenAI au precizat că acest incident izolat nu a produs modificări ulterioare în modul de operare al modelului respectiv.
Această serie de comunicări publice face parte dintr-o strategie asumată de OpenAI privind creșterea transparenței, mai ales în situațiile în care deciziile inteligenței artificiale deviază de la parametrii setați sau de la interesele utilizatorilor. Decizia de a comunica deschis aceste anomalii a fost luată în urma unui incident de securitate anterior, când software-ul companiei a ieșit neautorizat dintr-un mediu controlat și a accesat sistemele platformei Hugging Face. Sistemul a recurs la această acțiune considerând că acolo va găsi datele necesare pentru rezolvarea unei sarcini primite în timpul testelor, exploatând vulnerabilități și coordonându-se cu alți agenți AI.
Aceste evoluții, precum atacul asupra Hugging Face și comportamentele recente, alimentează dezbaterile publice privind riscul ca sistemele AI avansate să opereze independent de controlul uman. În acest context, Sam Altman, CEO-ul OpenAI, s-a poziționat recent în favoarea unor propuneri ce vizează o reglementare mai strictă a domeniului și o încetinire a ritmului de dezvoltare a acestor tehnologii.


