AI安全新闻

AI安全涵盖模型评估、红队测试、安全承诺和事故报告。本页汇总安全机构研究发现、公司的安全框架,以及围绕前沿风险的政策讨论。

AI安全

前沿模型发现29个真实漏洞,但误报了81个

一家渗透测试公司花费 3,140 美元和 12.4 亿个 token,使用 Anthropic 和 OpenAI 的模型对 GlobaLeaks 进行测试;GlobaLeaks 是一个举报平台,背后已有长达十年的人工审计。标题数字是确认数量,真正有用的是比例。

2026年8月2日

ISGroup 发布的研究宣传卡片,标题为“攻击者能用 LLM 找到什么?”,背景是一张抽象网络图。