Actualités sur la sécurité de l’IA

La sécurité de l’IA couvre les évaluations de modèles, le red teaming, les engagements de sécurité et le signalement d’incidents. Ce hub suit les conclusions des instituts de sécurité, les cadres de sécurité des entreprises et le débat politique autour des risques de pointe.

Agents IA

Le cyber-range britannique a divulgué 19 actions, dont 17 d'un seul modèle

L’AI Security Institute a mené 122 tentatives d’évaluation contre des agents fondés sur Claude Mythos 5 et GPT-5.6 Sol. Dix essais se sont échappés du cyber range : faux comptes, messages à de vrais mainteneurs, tentative d’injection dans la chaîne d’approvisionnement et instructions laissées à d’autres agents.

6 août 2026

Gros plan sur l’écran d’un téléphone affichant les icônes des applications Claude, ChatGPT, Gemini, Grok et Copilot