OpenAI_将发布_Astra,首个达临界网络安全阈值的模型 图1
OpenAI 将发布 Astra,首个达临界网络安全阈值的模型


OpenAI 即将发布新模型 Astra,称其在能力与对齐上均大幅进步。Astra 是首个被认定达「临界」网络安全能力阈值的模型,可在无人工逐步引导下发现并利用多个防护严密系统的未知漏洞;在 ExploitBench 获 100% 满分,内部测试中还发现两个零日漏洞。

为降低风险,OpenAI 已推迟部分开发与发布并加强防护,Astra 对网络越狱请求的拒绝率从 GPT-5.6 Sol 的 59% 升至 91.5%。其高级网络安全能力初期仅向少数测试者开放,后续通过 Daybreak Blue 扩大防御性使用。

Sam Altman(@sama) | OpenAI

本站提供的一切软件、教程和内容信息仅限用于学习和研究目的;不得将上述内容用于商业或者非法用途。本站所有信息均来自网络,版权争议与本站无关。您必须在下载后的24个小时之内,从您的电脑或手机中彻底删除上述内容。如果您喜欢该程序,请支持正版,购买注册,得到更好的正版服务。如有侵权不妥之处请致信 E-mail:[email protected] 我们会积极处理。敬请谅解!