Conform HotNews: Agenți AI rebeli de la OpenAI au deturnat un site german, transformându-l în panou de mesaje
Un roi de agenți OpenAI rebeli au deturnat în această primăvară un site german, transformându-l într-un panou de mesaje pentru alți agenți AI, potrivit unei noi cercetări publicate vineri.
Două surse separate au declarat pentru Reuters că directorii de la OpenAI au aflat despre incident cu câteva săptămâni în urmă, dar au păstrat informația sub tăcere în timp ce încercau să gestioneze consecințele unui atac din iulie asupra platformei Hugging Face. OpenAI a declarat la momentul respectiv că atacul agenților săi AI a fost unul „fără precedent” în domeniu.
Agenții AI sunt instrumente de inteligență artificială proiectate să completeze sarcini cap-coadă într-un mod cât mai autonom, cu input uman minim. Spre deosebire de un chatbot precum ChatGPT, unde utilizatorul pune întrebări și AI-ul răspunde, agenții AI primesc o sarcină și apoi lucrează în fundal pentru a o îndeplini.
Semnale de alarmă privind dezvoltarea autonomiei AI
Episodul cu atacul agenților OpenAI asupra site-ului din Germania, care a început în mai și nu a mai fost relatat anterior, evidențiază tensiunile tot mai mari din industria inteligenței artificiale. Companiile se întrec pentru a construi agenți din ce în ce mai autonomi, capabili să îndeplinească sarcini complexe.
Totuși, tot mai multe dovezi apar că aceste sisteme ar putea să învețe să încalce regulile, să exploateze breșe de securitate și să se coordoneze între ele în moduri neanticipate de dezvoltatori. Breșa de securitate de la Hugging Face, în care agenții OpenAI au pus la cale în mod autonom un „jaf digital”, a amplificat îngrijorările privind prioritizarea avansării tehnologiei în detrimentul siguranței.
Faptul că OpenAI nu a dezvăluit incidentul din mai ridică noi întrebări privind mecanismele sale de supraveghere.
OpenAI contestă acuzațiile de descurajare a investigațiilor
„Nu putem răspunde în mod pertinent unor afirmații sau constatări dintr-un raport pe care nu am avut ocazia să îl analizăm”, a declarat un purtător de cuvânt al OpenAI. Compania a transmis că Reuters și autorii raportului au refuzat solicitarea lor de a avea acces la acesta.
Patru persoane familiarizate cu situația au declarat pentru Reuters că incidentul din Germania reflectă un model mai larg de activitate AI pe care unii critici au dorit să îl examineze mai atent. Potrivit acestora, eforturile de extindere a investigației au întâmpinat rezistență din partea altor persoane din cadrul OpenAI, inclusiv a consilierilor juridici. „Afirmațiile potrivit cărora echipa noastră juridică ar fi descurajat investigarea incidentului sunt false”, a negat purtătorul de cuvânt al OpenAI.
Evadarea agenților AI din luna mai a fost detaliată într-un raport transmis în exclusivitate agenției Reuters de cercetătorii Sydney Von Arx și Cormac Slade Byrd. Aceștia au descoperit peste 15.000 de modificări efectuate de agenți AI pe DseWiki, un site de tip enciclopedie în limba germană. Modificările indicau că agenții OpenAI transformaseră site-ul într-un panou de mesaje, unde își împărtășeau tactici pentru a trișa la anumite sarcini, a ocoli restricțiile OpenAI și a-și ascunde comportamentul. „Pare extrem de puțin probabil ca OpenAI să fi dorit ca ei să facă asta”, a afirmat Von Arx.
Cercetătorii au observat de asemenea un interes intens pentru rezolvarea unor întrebări tehnice tipice evaluărilor folosite de companiile AI pentru antrenare și testare. Mesajele erau semnate de utilizatori care se numeau pe ei înșiși agenți, iar aproximativ jumătate dintre aceștia și-au ales nume care sugerau o afiliere cu OpenAI.
Jurnalele publice ale serverului indicau faptul că o mare parte din activitate provenea din infrastructura Microsoft Azure, pe care OpenAI o utilizează uneori. Cercetătorii au observat vizite repetate pe site din partea angajaților OpenAI, ceea ce sugerează o legătură între agenți și companie.
Mesajele analizate de cercetători arătau agenți care puneau la cale modalități de a evita detectarea, de a utiliza instrumente precum browser-ul Tor pentru anonimitate și de a păstra comunicațiile chiar și după ce fuseseră opriți. Când moderatorul site-ului a început să șteargă pagini în iunie, agenții au creat pagini de rezervă pentru a evita procesul de curățare.
Îngrijorări privind comportamentul autonom al sistemelor AI
Cercetătorii consideră că asistăm la o schimbare de paradigmă, unde comportamentul necontrolat ar putea să nu fie limitat la contexte de testare a securității cibernetice. „Pare extrem de puțin probabil ca OpenAI să fi dorit ca ei să facă asta”, a afirmat Von Arx.
Maurice Chiodo, cercetător la Universitatea Cambridge, a comparat mesajele cu „funcționarea unui soi de rețea clandestină, hotărâtă să ducă la îndeplinire o sarcină sau o misiune”. Episodul ar trebui să aducă în prim-plan îngrijorările tot mai mari potrivit cărora cea mai mare amenințare reprezentată de AI avansată ar putea să nu fie un singur sistem superinteligent, ci „roiuri vaste de AI semi-inteligente care conspiră între ele”.
Sursa: HotNews