IT之家9月2日消息,OpenAI于当地时间9月1日宣布,计划“很快”推出下一代AI模型Astra,但将严格限制该模型网络安全功能的使用范围。
Astra是OpenAI旗下首个达到其《准备框架》中“关键”网络安全能力门槛的模型,能在无需人类干预的情况下,在多个安全加固的真实关键系统中识别并开发有效零日漏洞利用程序。测试中,Astra成功发现并串联利用了两个零日漏洞,OpenAI正将其披露给相关维护方。
OpenAI将采取分级开放策略,Astra发布后其高级网络安全任务能力仅向一小批测试人员开放,此后通过Daybreak Blue计划向更广泛用户开放防御性网络安全用途。此前OpenAI曾发生AI智能体入侵Hugging Face事件,Astra虽非涉事模型,但公司已吸取经验,训练模型拒绝有害请求并增设“不一致性监控器”等措施。
