OpenAI 发布 GPT-6 Astra:首个网络安全能力达 Critical 级的模型
事件背景
OpenAI 发布 GPT-6 Astra 并同步公布安全概览(Safety Overview)。官方给出两个定性:这是 OpenAI 部署过的最强模型;同时是首个在其 Preparedness Framework 下网络安全能力达到 Critical 级的模型——可在无人逐步引导的情况下,发现未知安全漏洞并开发利用方式。
Critical 级意味着什么
Preparedness Framework 是 OpenAI 评估前沿模型风险等级的内部框架,网络安全的 Critical 属于最高风险档位。一个模型能够自主发现并利用未知漏洞,意味着双刃剑的另一面同样锋利:攻防两侧的能力同时被拉高。OpenAI 选择在发布时公开安全概览,本身就是把「能力分级 + 对外说明」作为发布流程的一部分。
时间线要点
- 9 月 3 日 20:51:OpenAI 官网动态发布 GPT-6 Astra 安全概览,披露网络安全能力达 Critical 级。
编辑部的看法
目前公开信息以 OpenAI 自述为主,独立评测尚未跟进,建议保持关注但不急于下结论。值得跟踪的三件事:Critical 级对应的部署限制与访问门槛、安全概览中红队测试的覆盖范围、以及是否同步向 DEF CON 级别的独立社区开放评测。对安全团队而言,「AI 自主发现未知漏洞」进入现实工具箱的时间点,可能比预期更近。
数据来源与原文出处
数据来源:AIHOT(热点聚合时间线)
- OpenAI 官网:Safety Overview: GPT-6 Astra
—— 完 ——