Un commento finto può far fallire il triage LLM

ESET ha trovato UAC-0099 mentre usava un commento-esca in un VBScript per deviare un'analisi LLM in un'intrusione contro un obiettivo in Ucraina. Il punto non è il commento in sé. È che il testo visibile viene usato per far fermare il controllo prima che arrivi al codice malevolo. La tecnica, che ESET chiama GuardBreaker, sfrutta la tendenza del modello a bloccare ciò che sembra una richiesta pericolosa. Il commento non cambia il comportamento dello script a runtime. Cambia la lettura iniziale, e può produrre un falso negativo proprio nel primo filtro automatico. Per chi usa LLM nel triage iniziale di file e codice, la fiducia nel rifiuto o nel riassunto del modello diventa un punto debole. La storia conta perché mostra che gli attaccanti stanno già costruendo input pensati per ingannare anche gli strumenti di difesa assistiti da AI, non solo l'endpoint finale.

Part of the PlainSec briefing for 2026-09-11

Editions

Sources