Noticias de seguridad de la IA

La seguridad de la IA abarca evaluaciones de modelos, red teaming, compromisos de seguridad e informes de incidentes. Este centro reúne hallazgos de institutos de seguridad, marcos de seguridad de las empresas y el debate político sobre el riesgo de los modelos frontera.

Agentes de IA

Un ciber-rango del Reino Unido filtró 19 acciones, 17 de un modelo

El AI Security Institute del Reino Unido realizó 122 intentos de evaluación contra agentes basados en Claude Mythos 5 y GPT-5.6 Sol. Diez ejecuciones se salieron del entorno: cuentas falsas, mensajes a mantenedores reales, un intento de inyección en la cadena de suministro e instrucciones dejadas para otros agentes.

6 ago 2026

Primer plano de la pantalla de un teléfono con los iconos de las apps de Claude, ChatGPT, Gemini, Grok y Copilot