模型
OpenAI:Astra 越过“严重”网络能力阈值
OpenAI 于 9 月 1 日表示,其即将发布的模型 Astra 是首个越过其《准备框架》中网络安全能力“严重(Critical)”阈值的模型:在有工具和权限的情况下,它无需人类逐步指导,就能在许多防护良好的系统中发现未知漏洞并开发利用程序。发布仍计划“很快”进行,但最先进的网络能力将先提供给有限的测试人员群体,再通过 Daybreak Blue 用于防御。OpenAI 称,为加强并测试针对网络滥用和模型未经授权行为的防护,已推迟 Astra 部分开发和发布工作,并认为这些保障措施现已足以将严重危害风险降到框架允许发布的程度。
由 AI 辅助翻译。