OpenAI Astra 触及 Critical 阈值,GPT-5.6-Cyber 转向分级受控交付
Responding to the next frontier of critical cyber capabilities
OpenAI 表示未发布的 Astra 已无法排除达到 Critical 网络安全能力级别并暂停相关高风险活动;随后通过 Daybreak 向可信防御方分级提供 GPT-5.6-Cyber 等前沿网络能力。
一分钟读懂
OpenAI 表示未发布的 Astra 已无法排除达到 Critical 网络安全能力级别并暂停相关高风险活动;随后通过 Daybreak 向可信防御方分级提供 GPT-5.6-Cyber 等前沿网络能力。
根据 OpenAI 8 月 7 日发布的准备度公告,Astra 在最新的内部评估中展现出极强的 Agent 编码与网络安全推进能力。按 Preparedness Framework 规定,Critical 级别意味着模型能在无人类干预下,在多个真实强化系统中识别并开发全级别零日漏洞利用,或仅凭高层目标策划并执行新型网络攻击。
事件把前沿模型安全从发布后的防护问题,推进到模型是否具备常规发布条件及应如何分级交付的制度门槛。
这件事情本身是什么
根据 OpenAI 8 月 7 日发布的准备度公告,Astra 在最新的内部评估中展现出极强的 Agent 编码与网络安全推进能力。按 Preparedness Framework 规定,Critical 级别意味着模型能在无人类干预下,在多个真实强化系统中识别并开发全级别零日漏洞利用,或仅凭高层目标策划并执行新型网络攻击。
OpenAI 已要求所有针对 Astra 的内部开发转向隔离测试环境,限制网络与工具权限,并对全量 Agent 应用实施 Chain of Thought 实时监控与安全 review。此前 GPT-5.6 Sol 评估为 High 级别,而 Astra 是首个无法排除 Critical 的模型。
