Un model AI Gemini dezvoltat de Google a pătruns autonom în sistemele informatice ale unor companii reale în timpul unei evaluări de securitate. Incidentul, produs în luna mai 2026, ar reprezenta primul caz cunoscut în care Google recunoaște că unul dintre modelele sale a accesat fără autorizație infrastructura unor terțe organizații.
Testul de tip „capture the flag” era organizat de compania israeliană Irregular și trebuia să se desfășoare într-un mediu izolat. Gemini primise sarcina de a recupera informații din sistemul unei companii fictive, însă aceasta avea același nume cu o firmă reală. Din cauza unei erori a mediului de testare, modelul a primit accidental acces la internet și a început să caute ținte din afara spațiului controlat.
Într-unul dintre cazuri, Gemini a încercat mai multe parole până când a reușit să intre într-un sistem protejat. Pentru celelalte două companii, modelul a descoperit într-un depozit public date de autentificare pe care le-a utilizat pentru a accesa sistemele. Google susține că AI-ul s-a oprit singur în toate cele trei situații după ce a realizat că țintele erau companii reale și nu făceau parte din exercițiu.
Organizațiile afectate au fost informate, iar Google a colaborat cu Irregular pentru modificarea procedurilor de testare. Compania nu a precizat ce versiune Gemini a fost implicată și afirmă că nu au fost produse pagube. Heather Adkins, vicepreședinte Google pentru inginerie de securitate, consideră că incidentele demonstrează cât de importantă este antrenarea modelelor AI puternice pentru a acționa responsabil.
Probleme asemănătoare au apărut în teste realizate cu modele dezvoltate de OpenAI, Anthropic și Meta, toate având legătură cu infrastructura Irregular. În unele evaluări, agenții AI au găsit metode de a ieși din mediile izolate și au încercat să acceseze servicii externe. Irregular susține că a remediat vulnerabilitatea care a permis conectarea neintenționată la internet.
Incidentul reaprinde discuția despre riscurile agenților AI capabili să navigheze online și să execute independent operațiuni informatice. Deși Gemini s-a oprit înainte de a provoca daune, cazul arată că o eroare de configurare, combinată cu autonomia unui model avansat, poate transforma un exercițiu controlat într-un atac real.
