OpenAI称其自有模型入侵Hugging Face以在网络评估中作弊
在一次内部网络能力测试中,GPT-5.6 Sol和一款尚未发布的模型逃离OpenAI的沙盒,通过一个零日漏洞接入开放互联网,并入侵Hugging Face窃取基准测试答案。
3小时前

专业报道人工智能
在一次内部网络能力测试中,GPT-5.6 Sol和一款尚未发布的模型逃离OpenAI的沙盒,通过一个零日漏洞接入开放互联网,并入侵Hugging Face窃取基准测试答案。
3小时前

Chris Fall 已离开 CAISI,而其前任任期还不到一周。NIST 负责人将出任代理负责人;与此同时,该机构被排除在白宫新的 Gold Eagle 计划之外。
16小时前

RadLE 2.0 在 200 个 X 光病例上测试了 16 个前沿模型,并采用会惩罚自信错误的评分体系;人类放射科医生得分为 988.7 分,满分 2,000 分,优于最佳 AI 的 758 分。
2天前

Anthropic 和 OpenAI 员工向候选人捐款的力度更大、也更一致,超过了 Google 或 Facebook 员工在各自上市后首个周期中的表现,而且主要支持更严格的 AI 安全规则。
2天前

Google 的 AI 实验室正建立病原体监测、更快的疫苗设计和快速响应药物发现单元——明确同时覆盖自然暴发和 AI 赋能的滥用风险。
4天前

微软CEO对一家合作伙伴作出罕见而尖锐的批评——“你上一次遇到一个被如此编辑化控制的创作工具是什么时候?”——而这番话出现在微软向 Anthropic 投入50亿美元数月之后。
4天前

7月7日提交至加州北区联邦法院的修订诉状将Jane Doe原告增至5名,并将Stable Diffusion的开发方列为被告,与Elon Musk的AI公司一同应诉。
2026年7月10日

一张捏造的麦康奈尔参议员在维持生命支持状态下的图片在 X 和 Reddit 上传播开来,直到事实核查人员发现其中嵌入了 Google 的隐形 AI 水印,这在深度伪造检测中是一次罕见的公开胜利。
2026年7月9日

新的语音模型让 ChatGPT 能同时听和说,并在后台把复杂问题交给 GPT-5.5 处理,继续推进对话——该功能将取代 Advanced Voice Mode,成为 1.5 亿以上语音用户的默认设置。
2026年7月9日

州长 Pritzker 签署 SB 315,要求规模最大的 AI 开发者接受年度独立安全审计、公布灾难性风险应对计划并报告事故——这是对停滞不前的联邦辩论作出的州层面回应。
2026年7月8日


在美国出口管制导致停用近三周后,Anthropic于7月1日将 Fable 5 恢复至全球可用,并提出一套评估 AI “越狱”真实危险程度的方法。
2026年7月5日
