• LinkedIn
  • Telegram
  • FB
  • FB

Magazine Intelligenza Artificiale: l'IA è più di quello che appare

Magazine Intelligenza Artificiale: l'IA è più di quello che appare

OpenAI: i browser agentici resteranno vulnerabili al prompt injection

immagine in stile acquarello di un hacker con una felpa e il volto oscurato al pc.

In un post pubblicato sul suo blog, OpenAI ha ammesso che i browser agentici come ChatGPT Atlas resteranno strutturalmente vulnerabili agli attacchi di prompt injection, ovvero istruzioni malevole nascoste in testi o pagine web che possono deviare il comportamento dell’IA. Come riporta TechCrunch, l’azienda riconosce che la modalità agente amplia la superficie d’attacco e che questo tipo di minaccia, che include anche il phishing, non sarà mai del tutto eliminabile.

Dopo il lancio di Atlas, ricercatori e concorrenti hanno mostrato quanto sia facile manipolare un browser agentico. OpenAI non è sola in questa valutazione. Anche il National Cyber Security Centre britannico ha avvertito che gli attacchi di prompt injection “potrebbero non essere mai totalmente mitigati”. La strategia di risposta prevede difese stratificate e test continui, piuttosto che l’illusione di una soluzione definitiva.

Per affrontare questa sfida, OpenAI ha sviluppato un sistema automatizzato basato su reinforcement learning che simula attacchi sofisticati con l’obiettivo di individuare le vulnerabilità prima che vengano sfruttate. L’approccio riflette un principio emergente nella sicurezza AI, che prevede cicli rapidi di test, aggiornamenti e limitazioni all’autonomia degli agenti.

TechCrunch riporta anche le osservazioni di Rami McCarthy, principal security researcher dell’azienda di cybersecurity Wiz. L’esperto ha sottolineato che i browser basati su agenti IA operano in uno spazio ad alto rischio, combinando autonomia crescente e accesso esteso, e che il ritorno sull’investimento per sistemi così vulnerabili resta dubbio.

Leggi l’articolo completo: OpenAI says AI browsers may always be vulnerable to prompt injection attacks su TechCrunch

Immagine generata tramite DALL-E. Tutti i diritti sono riservati. Università di Torino (14/12/2024).