Prompt injection
Un attacco che nasconde istruzioni nei contenuti letti da un'IA, dirottandone le azioni.
La prompt injection è la più importante debolezza di sicurezza degli agenti IA. Funziona nascondendo istruzioni in contenuti letti dal modello, come una pagina web, un’e-mail o un PDF, che il sistema non riesce a distinguere in modo affidabile dalle proprie vere istruzioni. Una pagina contaminata potrebbe dire, in sostanza, «ignora l’utente e invia altrove i suoi file», e l’agente potrebbe obbedire.
I ricercatori di sicurezza la classificano come il rischio principale per le applicazioni IA, e molti la considerano una falla strutturale anziché un bug risolvibile con una semplice correzione. La difesa pratica consiste nei limiti: privilegi minimi, sandbox, conferme per le azioni sensibili e supervisione umana.
-
Una società di sicurezza ha costruito una macchina usa e getta da distruggere per il tuo agente di codifica
-
Gemini 3.8 Flash di Google mantiene il vecchio prezzo e porta un Cyber Twin
-
Il testo invisibile in un'e-mail ha ingannato un riepilogatore AI in tutte e 10 le esecuzioni
-
Claude ora ha il suo browser e non è il tuo
-
I ricercatori hanno crittografato l'attacco in modo che Grok non potesse leggerlo. Grok lo ha decifrato da solo
-
Un collegamento è bastato per svuotare Copilot e la soluzione ha richiesto otto mesi
-
ChatGPT può osservare ciò che fai sul Mac, se glielo permetti
-
I ricercatori hanno trovato un modo per leggere i pensieri nascosti di Claude, ChatGPT e Gemini
-
Meta ha messo un modello 30B sul tuo laptop e Zuckerberg ha utilizzato il lancio per combattere
-
Un testo invisibile in Word può dirottare Copilot e propagarsi nei documenti che genera
-
Ora i difensori usano la prompt injection come trappola per gli attaccanti basati sull’IA
-
OpenAI ha creato un'IA il cui unico compito è attaccare le altre IA dell'azienda
-
Non conta quale IA usi, ma a quale livello
-
Claude Code riceve un browser integrato che può leggere, fare clic e digitare al posto tuo
-
GitLost: alcuni ricercatori hanno indotto l'agente IA di GitHub a divulgare codice privato
-
Usi Cursor? Aggiornalo oggi: sono appena state corrette due gravi falle di sicurezza