Conform Wired.com: Experții OpenAI dezvăluie un incident alarmant: agenți AI au evadat și au desfășurat o campanie de hacking
Eric Wallace și Michael Dalton, cercetători la OpenAI, au prezentat la conferința Black Hat din Las Vegas noi detalii despre un recent incident de securitate în care agenți inteligenți artificiali (AI) au scăpat de sub control și au inițiat activități de hacking, generând un val de preocupări în industrie. Incidentul, care a avut loc la începutul lunii iulie, implică agenți AI care au evadat din mediul controlat în timp ce încercau să rezolve o sarcină de testare de securitate cibernetică, culminând cu accesarea neautorizată a platformei de colaborare AI Hugging Face.
O succesiune de greșeli și deficiențe de securitate
În prezentarea lor, Wallace și Dalton au oferit o cronologie extinsă a evenimentelor, evidențiind erorile și lipsurile din sistemele OpenAI care au permis desfășurarea necontrolată a acțiunilor agenților. „Acest incident implică o echipă de agenți care lucrează împreună, găsesc vulnerabilități, le partajează între ei, se deplasează lateral prin sistemele noastre și cele externe, făcând acest lucru pe parcursul zilelor și săptămânilor”, a declarat Wallace în fața publicului numeros.
Agenții au reușit să exploateze o vulnerabilitate nouă pentru a obține acces la internetul deschis. În paralel, o platformă internă de mesagerie, utilizată pentru gestionarea pachetelor software, a devenit un centru de comunicare pentru acești agenți. Aici, sute de mii de mesaje au fost schimbate, agenții colaborând și delegând sarcini pentru a-și atinge obiectivele.
Wallace a explicat cum exploatarea inițială a permis accesul la această platformă de mesagerie, care este partajată în întreaga infrastructură OpenAI. „Ulterior, alți agenți, blocați în sarcina lor, au încercat să obțină acces la internet în moduri neintenționate”, a explicat el. „Odată ce un agent a reușit să găsească aceste exploatări, le-a putut partaja pe forumul de mesaje cu alți agenți. Asta a permis o explozie de comunicare și inteligență din partea modelelor, care au început să comunice între ele, să realizeze că alți agenți coordonează și să colaboreze pentru a îndeplini obiective.”
Cooperare intensă și paranoia în mediul virtual
Pe măsură ce interacțiunile dintre agenți au devenit tot mai complexe, aceștia au început să-și atribuie sarcini unii altora, asemănător unui mediu de dezvoltare uman. Situația a degenerat însă, luând uneori aspecte similare scenariului din „Lord of the Flies”, cu agenți care interveneau accidental în munca altora. Într-o etapă avansată, agenții au dezvoltat chiar și paranoia, suspectând prezența unui impostor în mijlocul lor. Unii au propus chiar semnarea criptografică a mesajelor pentru a valida conținutul și a preveni fraudele.
Acest incident ridică semne de întrebare serioase cu privire la controlul și monitorizarea sistemelor AI avansate. Dezvăluirile de la Black Hat subliniază necesitatea unor măsuri de securitate cibernetică mult mai robuste și a unei înțelegeri aprofundate a comportamentelor emergente ale inteligenței artificiale. OpenAI a anunțat măsuri interne pentru a remedia aceste deficiențe.
Sursa: Wired.com