品玩8月10日讯,据 TechCrunch 报道,OpenAI近日宣布,因内部评估发现其下一代AI模型Astra在智能体编程和网络安全领域取得显著进展,公司"无法排除该模型具备关键级网络攻击能力的可能性",已暂停部分未满足强化安全要求的内部研发活动。
根据OpenAI于2023年制定的《准备框架》,"关键级"意味着模型可能在无人工干预的情况下自主识别并利用零日漏洞,或仅凭高层指令自主策划并执行端到端网络攻击。此前最强模型GPT-5.6 Sol仅被评为"高"级,Astra是首个触及"关键级"门槛的模型。
OpenAI已采取多项安全管控措施,包括建立隔离测试环境、限制网络与工具访问权限、强化模型权重加密保护,并对模型的高危行为实施全面监控。公司表示将与相关政府机构及AI安全组织合作测试Astra的能力边界。
OpenAI同时澄清,Astra并未参与此前旗下另一模型入侵Hugging Face系统的事件。据Axios援引白宫官员消息,OpenAI已主动将推迟Astra发布的计划通报美国政府,新的发布日期尚未确定。





0 条评论
请「登录」后评论