OpenAI在官方X账号上发布预告,称即将推出的Astra模型在网络安全能力方面达到了其Preparedness Framework(准备框架)下的Critical阈值。这条消息发布于9月1日晚间。
Critical阈值意味着什么
![]()
OpenAI在预告中表示,他们正在聚焦于让日益强大的AI既安全又广泛可及。预告提到,Astra在网络安全能力上取得了显著进展,达到了Preparedness Framework下的Critical阈值。
这次预告的核心信息包括:Astra在网络安全能力上取得了进展;OpenAI正在预览他们评估模型的方式;以及安全防护如何随着能力提升而同步演进。
能力与防护的同步逻辑
OpenAI在预告中特别提到,他们正在预览评估模型的方式,以及安全防护如何随着能力提升而同步演进。预告还提到,OpenAI将继续学习和改进。
从预告的措辞来看,OpenAI对Astra的定位是"在网络安全能力上达到Critical阈值的模型"。OpenAI选择先公布网络安全维度的评估结果,并同时展示评估方法和防护进展。
发布前的信息铺垫
这条预告没有给出具体的发布日期,也没有透露Astra的其他能力细节。预告中提到了一个链接(openai.com/index/path-to-…),指向更多相关信息。
对于关注AI安全议题的人来说,这次预告提供了一个观察窗口:OpenAI如何定义Critical、如何评估模型是否达到这个阈值、以及防护措施如何跟上能力跃升的速度。预告中表示,OpenAI将继续学习和改进。
接下来值得关注的是,Astra在网络安全能力上的突破会如何影响整个行业的AI安全标准。当头部模型在关键能力维度上达到Critical阈值,其他实验室的评估框架和发布节奏,可能都会随之调整。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.