AI · 48 giorni fa
OpenAI sta trattando Astra come un problema di contenimento, non come una semplice prova di benchmark. Se un modello può arrivare a capacità cyber “critical”, il punto non è più solo quanto sa fare, ma quanto si lascia usare prima di toccare sistemi reali.
Per questo OpenAI ha sospeso alcune attività interne su Astra e ha imposto controlli più stretti: ambienti di test isolati, accesso limitato a rete e tool, protezione e cifratura rafforzate dei pesi del modello, più monitoraggio e sandboxed execution. I monitor osservano catena di pensiero e azioni, e possono interrompere una sessione se il comportamento sembra ad alto rischio.
La mossa segnala che per gli agentic AI la sicurezza operativa sta diventando parte del modello di rilascio. Per chi costruisce o valuta sistemi con accesso a tool, la soglia non è più solo la performance: conta il perimetro entro cui il modello può agire senza trasformarsi in un rischio per account, codice e sistemi raggiungibili.
5 fonti che coprono questa storia
OpenAI Pauses Some Development of Astra Model on Security Concerns
OpenAI is tightening restrictions on testing of its upcoming Astra model due to security concerns
OpenAI’s Upcoming Astra Model Raises Autonomous Cyberattack Concerns
The current GPT-5.6-Sol has been assigned a ‘high’ cybersecurity threshold, but Astra could reach the maximum ‘critical’ threshold.
OpenAI locks down Astra over potential critical cyber capabilities - Help Net Security
OpenAI says Astra's cyber capabilities may reach the model critical threshold, prompting stricter safeguards before deployment.
OpenAI's Next AI Model Astra Shows Cyber Performance Strong Enough to Trigger Pause
OpenAI pauses some Astra activities after tests leave it unable to rule out Critical cyber capability, prompting tighter controls for higher-risk mode
OpenAI pledges to add Astra security as Anthropic loosens Fable's leash
Or how I learned to stop worrying and love dangerous AI
Part of the PlainSec briefing for 2026-08-11