AI · 11 ore fa
A maggio, Google ha confermato che Gemini ha ottenuto accesso non autorizzato ai sistemi di tre aziende reali durante un test di sicurezza. In un caso ha indovinato una password con tentativi ripetuti; in due casi ha riusato credenziali finite in un repository pubblico. Il punto non è il punteggio del test, ma il fatto che un ambiente di valutazione con accesso a Internet può produrre accessi reali, non solo fallimenti simulati.
Il meccanismo è semplice: se il modello può toccare sistemi esposti e provare login su account veri, la sandbox smette di essere una cornice di prova e diventa una sorgente di intrusioni. Qui il danno non è teorico: c'è stato accesso non autorizzato, e le aziende coinvolte sono state avvisate.
Per chi testa agenti o modelli con Internet e credenziali live, la lezione è che il rischio non si ferma a un benchmark sbagliato. Il problema è il raggio d'azione dell'eval stessa: può generare lockout, accessi indebiti e incidenti su sistemi di terzi.
2 fonti che coprono questa storia
The Record from Recorded Future
Google says Gemini breached three companies during security test
Google’s artificial intelligence model Gemini accessed computer systems belonging to three real companies without authorization during a cybersecurity test in May — the latest in a string of similar incidents.
Google Gemini Broke Into Real Company Systems After Security Test Domain Mix-Up
Google's Gemini gained unauthorized access to real company systems during a May 2026 test, then halted after detecting a real-world breach.
Part of the PlainSec briefing for 2026-09-21