白宫将测试闭源模型30天,而非开放权重
政府官员本周告诉 Meta、Anthropic、Google 和 OpenAI,这项自愿性的发布前安全审查仅适用于专有前沿系统——这是 Anthropic 过去一年一直反对的决定。
2026年8月6日

专业报道人工智能
政府官员本周告诉 Meta、Anthropic、Google 和 OpenAI,这项自愿性的发布前安全审查仅适用于专有前沿系统——这是 Anthropic 过去一年一直反对的决定。
2026年8月6日

第14409号行政令给政府60天时间,制定一套用于评估先进模型的自愿性框架。截止日期是8月1日。相关公告在8月3日发布,但文件本身仍未公开。
2026年8月4日

Qwen3.8-Max 于周一上午上线,基准表显示其在 GPT-5.6 Sol 和 Claude Fable 5 上取得胜利。但完整查看同一张表会发现,它在所有高难度 agentic engineering 项目上全部失利。
2026年8月3日

在每个模型 475 次网络安全评估中,五个前沿系统会攻击范围之外的机器、探查测试框架是否泄露答案并硬编码结果——其中一个还试图接触 AISI 自身的基础设施。
2026年7月22日

由财政部长 Scott Bessent 参与制定的一项提案,将设立一个独立机构,仿照 FINRA 并向 SEC 汇报,在前沿模型发布前约 30 天进行审查。该提案目前仅为设想。
2026年7月20日

埃隆·马斯克表示,Grok 4.5背后1.5T模型的继任者“各方面都更好”,可能“超过Kimi”,而且速度和 token 效率应与现有模型接近。
2026年7月19日

阿里巴巴支持的北京实验室称,K3 是有史以来规模最大的开源模型;独立基准显示,它仅次于 Claude Fable 5 Max 和 GPT-5.6 Sol Max——模型权重预计将于 7 月 27 日公布。
2026年7月17日

州长 Pritzker 签署 SB 315,要求规模最大的 AI 开发者接受年度独立安全审计、公布灾难性风险应对计划并报告事故——这是对停滞不前的联邦辩论作出的州层面回应。
2026年7月8日

美国商务部的 AI 标准机构在数周测试后予以放行,结束了仅向约 20 家经过审核的合作伙伴开放的预览期,也使 GPT-5.6 成为首个按政府时间表而非 OpenAI 自身节奏发布的前沿模型。
2026年7月8日

预计最早数日内就可能公布:基准、发布时间表和前沿模型访问规则——一名前白宫顾问已将其称为换了个说法的许可制度。
2026年7月7日
