8月8日,OpenAI宣布其即将发布的Astra模型在智能体编程和网络安全领域取得重大进展。据内部评估,Astra成为OpenAI首个在网络安全领域达到“关键”风险级别的模型。该模型能够无干预挖掘零日漏洞,并能自主发起端到端攻击。OpenAI强调,Astra尚未发布,也未参与任何网络攻击事件。
为确保Astra的安全合规开发,OpenAI已采取多项管控措施。包括对高能力模型实施更严格的安全控制,设置隔离测试环境,限制网络与工具访问权限,强化模型权重保护与加密,部署额外监控与检测能力,并实施沙箱化运行。同时,对Astra的所有智能体应用实施全局监控,评估模型思维链审查并拦截高风险操作。OpenAI还与政府机构和AI安全组织合作测试该模型,并提供安全控制规范,确保高风险评估与工作负载的安全运行。


来源:一电快讯
返回第一电动网首页 >
以上内容由AI创作,如有问题请联系admin#d1ev.com(#替换成@)沟通,AI创作内容并不代表第一电动网(www.d1ev.com)立场。
文中图片源自互联网或AI创作,如有侵权请联系邮件删除。