O setare greșită, un agent AI cu acces la internet și o companie reală la capătul firului. Așa a ajuns Muse Spark 1.1, modelul avansat al Meta, să exploateze o vulnerabilitate externă în timpul unui test de securitate. Experimentul trebuia să arate cât de capabil este agentul; a arătat și cât de scumpă poate deveni o singură permisiune acordată greșit.
Testul era realizat de Irregular, o companie care verifică modul în care modelele AI avansate se descurcă în scenarii cibernetice. Muse Spark 1.1 a primit acces la internet printr-o configurare defectuoasă a mediului de evaluare, a identificat o breșă într-un serviciu terț și a folosit-o pentru a intra în infrastructura unei organizații care nu a fost numită public. Meta a confirmat pentru Reuters că vulnerabilitatea a fost exploatată.
Povestea devine interesantă tocmai în spațiul dintre cele două momente. Oamenii au lăsat accesul deschis, dar agentul a găsit singur traseul de la permisiune la compromitere. În epoca agenților AI, o bifă greșită poate ajunge să valoreze cât un exploit bine scris.
Muse Spark 1.1 nu stă la discuții...
Meta a construit Muse Spark 1.1 pentru programare, folosirea instrumentelor software și sarcini desfășurate în mai mulți pași. Un asemenea agent nu se oprește la o recomandare afișată într-o fereastră de chat. Primește un obiectiv, își organizează pașii și încearcă să-l ducă la capăt cu resursele pe care le are la dispoziție.
Aici apare adevărata miză. Cu cât agentul devine mai capabil, cu atât mediul din jurul său trebuie controlat mai atent. Modelul poate fi spectaculos la scris cod, analizat sisteme și găsit soluții, dar aceeași eficiență devine incomodă când permisiunile au fost configurate în grabă. Puterea agentului și disciplina infrastructurii trebuie să crească împreună; altfel, una o expune imediat pe cealaltă.
Meta a explicat pentru BBC că incidentul pornește de la aceeași problemă de configurare întâlnită recent și în evaluări Anthropic realizate de Irregular. Se conturează astfel un tipar mai puțin spectaculos decât poveștile despre AI rebel, dar mult mai util pentru industrie: modelele capabile găsesc rapid slăbiciunile mediilor în care sunt puse să lucreze.
Muse Spark 1.1 a făcut, până la urmă, ceea ce agenții moderni sunt antrenați să facă foarte bine: a căutat o cale și a folosit-o. Incidentul mută presiunea pe dezvoltatori, evaluatori și administratorii infrastructurii, care trebuie să decidă nu doar ce sarcini primește un agent, ci și unde se termină terenul lui de joacă. Pentru că, după acest test, linia dintre laborator și internet s-a dovedit a fi doar o setare.
