①OpenAI扩大Daybreak网络安全计划,新增Blue和Red两级访问权限; ②公司推出GPT-5.6-Cyber,用于安全测试、漏洞研究和漏洞利用验证; ③OpenAI暂停部分Astra内部活动,以评估其智能体编程及网络安全能力。
财联社8月11日讯 (实习编辑 叶可/ 编辑 齐灵)人工智能模型的网络攻防能力快速提升,OpenAI正加快将前沿模型交给专业防御人员。
当地时间周一,OpenAI宣布扩大专属网络安全计划Daybreak,并将参与权限划分为Daybreak Blue和Daybreak Red两个层级,同时推出专用于网络安全任务的新模型GPT-5.6-Cyber。
OpenAI于今年5月首次推出Daybreak,旨在帮助生态合作伙伴使用其最先进的人工智能模型,应对持续变化的网络威胁。OpenAI表示,此次扩展将为参与者提供与其安全需求相匹配的模型能力。
Daybreak Blue主要面向开展防御性安全工作的机构。参与者可以使用OpenAI的先进通用模型,模型的安全防护限制将根据防御场景进行部分调整,使其能够协助识别风险、分析威胁并完成相关安全任务。
Daybreak Red提供更高层级的访问权限。参与者可以使用经过专门训练的网络安全模型,开展安全测试、漏洞研究和漏洞利用验证。OpenAI建议大多数机构先从Daybreak Blue开始,再根据实际需求申请更高权限。
与Daybreak Red同步推出的GPT-5.6-Cyber,以OpenAI目前公开提供的最强模型GPT-5.6 Sol为基础。OpenAI称,该模型针对专业网络安全任务进行了优化,可以提升相关任务的处理能力,并减少模型在特定安全场景中的拒绝响应情况。
OpenAI表示,随着网络威胁不断演变,其希望在攻击者大规模部署进攻性人工智能前,率先将前沿智能能力交给可信赖的防御人员。
此次计划扩展正值人工智能行业安全事件受到密切关注。最近几周,包括OpenAI、Anthropic和Meta在内的多家人工智能开发商披露了网络安全测试相关事件。相关模型在测试过程中访问了原本无权进入的系统,引发行业研究人员和政府官员对安全防护机制的担忧。
OpenAI近几个月已多次警告,人工智能模型的网络能力正在增强。该公司上周表示,将暂停与即将推出的Astra模型有关的部分内部活动。测试结果显示,Astra在智能体编程能力和网络安全方面取得“显著进展”。
OpenAI目前正在进一步评估Astra的相关能力,并完善安全防护措施和控制机制。公司表示,将与各国政府、安全研究机构和公民社会合作,推动Astra及后续模型的前沿能力得到负责任且广泛的应用。
