Sicurezza AI · Attacco basato su AI

Structured Outputs Can Smuggle Malicious Payloads

Un modello può rifiutare il prompt e comunque trasmettere il pericolo a valle. La rottura non è nella risposta testuale in sé. È nella struttura nascosta, dove istruzioni malevole possono viaggiare all’interno di JSON dall’aspetto benigno e sopravvivere ai controlli basati solo sulla semantica.

1 fonte · 18 mag

Cronologia

Fonti

Part of the PlainSec briefing for 2026-05-18

Every edition of this story: Structured Outputs Can Smuggle Malicious Payloads