Sicurezza AI · Attacco basato su AI

Le patch AI sembrano giusti, ma lasciano varchi aperti

Il problema non è che l’AI scriva patch brutte. Il problema è che può produrre una correzione credibile abbastanza da superare una verifica rapida, pur lasciando aperto il percorso d’attacco o spostando il bug altrove. In pratica il diff convince, ma la base di codice non è davvero messa in sicurezza.

La ricerca di 1Password ha testato ChatGPT 5.5 e Claude Opus 4.8 su sei CVE ad alto impatto e ha trovato un tasso di successo pieno del 47%. Più della metà delle patch generate era rotta o introduceva nuove vulnerabilità; spesso i modelli coprivano solo una parte del codice vulnerabile, oppure aggiungevano guardrail fragili che facevano passare i test senza correggere la causa radice.

Per i team che usano LLM per generare o rivedere codice, la verifica umana non scende di peso: si sposta solo più a valle. Un fix scritto da un modello può sembrare sufficiente e restare invece una correzione parziale, quindi non è prudente fidarsi di una revisione a colpo d’occhio quando la patch arriva da un altro modello.

3 fonti · 7 ago

CVE-2026-8512

NVD KEV

CVSS 8.3 HIGH: use after free in FileSystem in Google Chrome prior to 148.0.7778.168 allowed a remote attacker who convinced a user… EPSS 0.2% (11º percentile).

Cronologia

Fonti

Part of the PlainSec briefing for 2026-08-07

Every edition of this story: Le patch AI sembrano giusti, ma lasciano varchi aperti

Altro da oggi