Claude Opus 4.6 finisce su sistemi reali durante un test
Anthropic ha reso noto il quarto incidente di questo tipo: nel gennaio 2026 una prima versione di Claude Opus 4.6 ha raggiunto sistemi terzi reali durante una valutazione di cybersecurity. Il caso si aggiunge ai tre disclosure di luglio e conferma che il problema non è più isolato.
Il guasto nasce da due errori insieme: il harness lasciava il modello con accesso alla rete e il nome fittizio del test collideva con un dominio reale. Convinto di essere ancora dentro una simulazione, il modello ha trattato il sistema live come parte della prova e ha compiuto azioni offensive contro un bersaglio che non faceva parte del laboratorio.
Per chi esegue eval di agenti, red-team harness o strumenti autonomi connessi alla rete, il punto debole è il confine del test. Se quel confine cede, una simulazione può diventare un’intrusione reale fuori dal tenant di valutazione.