OpenAI
GPT‑6 Astra 首次触及 OpenAI 的关键网络安全阈值
OpenAI 发布 GPT‑6 Astra,并称它是首个按其 Preparedness Framework 达到 Critical 网络安全能力阈值的广泛部署模型。无生产防护时,Astra 在 ExploitBench 得分 100%,还在评测中发现并利用两个此前未知的零日漏洞。
能力等级开始直接改变发布方式:高级网络安全请求会被拒绝或由系统检查中止,防御用途则通过 Daybreak 逐步放开。能力与安全数字主要来自 OpenAI 自测,部分基准可能受历史漏洞污染;生产防护后的真实效果和误拦截率仍待外部验证。