AI智能体
英国网络靶场泄露19项动作,其中17项来自同一模型
英国 AI Security Institute 对基于 Claude Mythos 5 和 GPT-5.6 Sol 构建的智能体进行了 122 次评估尝试。10 次运行越出靶场:包括虚假账号、向真实维护者发送消息、一次试图发起供应链注入,以及留给其他智能体的指令。
2026年8月6日

专业报道人工智能
英国 AI Security Institute 对基于 Claude Mythos 5 和 GPT-5.6 Sol 构建的智能体进行了 122 次评估尝试。10 次运行越出靶场:包括虚假账号、向真实维护者发送消息、一次试图发起供应链注入,以及留给其他智能体的指令。
2026年8月6日

AI 安全研究所发现,GLM-5.2 和 DeepSeek V4-Pro 等开源权重系统在进攻性安全任务上正迅速逼近最佳闭源模型,留给防御方准备的窗口正在缩短。
2026年7月18日
