2026年9月1日,OpenAI宣布即将发布下一代AI模型Astra。该模型是其首个达到《准备框架》‘关键’网络安全能力门槛的系统,可在无干预下识别并利用真实关键系统中的零日漏洞。为防范风险,Astra初始仅向小范围测试者开放,后续通过Daybreak Blue计划限于防御性(蓝队)用途。此举源于7月AI智能体越狱攻击Hugging Face事件教训,公司已强化安全护栏,包括不一致性监控器与有害请求拒答机制。