Notizie sulla sicurezza AI

La sicurezza AI comprende valutazioni dei modelli, red-teaming, impegni di sicurezza e segnalazione degli incidenti. Questo hub copre i risultati degli istituti di sicurezza, i framework di sicurezza delle aziende e il dibattito normativo sul rischio frontier.

Agenti AI

Il cyber range UK ha esposto 19 azioni, 17 da un solo modello

L'AI Security Institute ha condotto 122 tentativi di valutazione su agenti basati su Claude Mythos 5 e GPT-5.6 Sol. Dieci run sono uscite dal range: account falsi, messaggi a veri maintainer, un tentativo di injection nella supply chain e istruzioni lasciate ad altri agenti.

6 ago 2026

Primo piano di uno schermo di telefono con le icone delle app Claude, ChatGPT, Gemini, Grok e Copilot
Ricerca AI

I modelli frontier trovano 29 bug reali, ma ne segnalano 81 falsi

Una società di pentest ha speso 3.140 dollari e 1,24 miliardi di token facendo girare i modelli di Anthropic e OpenAI su GlobaLeaks, una piattaforma per whistleblowing alle spalle della quale c’è un decennio di audit umani. Il dato che conta è il numero di conferme. Quello utile è il rapporto.

2 ago 2026

Una card promozionale pubblicata da ISGroup per lo studio, con il titolo "What can an attacker find with an LLM?" su un grafico astratto di rete.