AI · 4 ore fa
OpenAI ha interrotto una campagna coordinata che puntava a estrarre reasoning protetto dai suoi modelli, con attività iniziate il 1 luglio e impennate il 24-25 luglio. Il cluster centrale è stato attribuito da OpenAI a persone associate a Moonshot AI. La stessa società dice di aver visto oltre 15.000 utenti coinvolti in attività correlate.
Il punto non è un furto di database o di conversazioni memorizzate. Gli operatori hanno martellato il modello con richieste coordinate fino a fargli riprodurre il reasoning protetto in forme visibili a chi chiedeva, cioè hanno estratto comportamento di modello attraverso l’interazione, non attraverso un accesso al back-end. OpenAI dice di aver chiuso anche un percorso che permetteva il replay di reasoning già posseduto e di aver aggiunto controlli sullo streamed output.
Per chi gestisce chatbot, copilot o agenti che mostrano reasoning o stream di output, il rischio resta nel punto di contatto con l’utente: la superficie di chat e il trattamento dell’output diventano il vero bersaglio. Se quel livello espone troppo, un attacco a scala può replicare o far trapelare comportamento del modello senza toccare dati archiviati.
3 fonti che coprono questa storia
OpenAI Disrupts Reasoning Extraction Campaign Linked to Moonshot AI Associates
OpenAI disrupted a coordinated campaign attributed to Moonshot AI associates that sought to extract protected reasoning at scale.
Srsly Risky Biz: “Rogue AI” isn’t going anywhere
Amberleigh Jack and James Wilson chat about OpenAI agents’ recent escapades into Australian government websites.
Admits its agents side-swiped four Australian government sites
Part of the PlainSec briefing for 2026-10-01