网络安全
GPT-5.3-Codex 是我们首个根据 Preparedness Framework 被视为具备高网络安全能力的模型,该框架要求采取额外的安全措施。这些安全措施包括训练模型拒绝明显的恶意请求,例如窃取凭据。
除安全训练外,基于自动分类器的监控系统还会检测可疑网络活动的信号,并将高风险流量路由至网络安全能力较弱的模型(GPT-5.2)。我们预计只有极少部分流量会受到这些缓解措施的影响,并正在持续完善我们的政策、分类器和产品内通知。
我们这样做的原因
Section titled “我们这样做的原因”近几个月来,我们看到模型在网络安全任务上的性能取得了显著提升,为开发者和安全专业人员带来了益处。随着我们的模型在漏洞发现等网络安全相关任务上的能力不断增强,我们采取预防性措施:扩大保护和执行措施的范围,在支持合法研究的同时减缓滥用。
网络安全能力本质上具有双重用途。同样支撑重要防御工作的知识和技术——渗透测试、漏洞研究、大规模扫描、恶意软件分析和威胁情报——也可能助长现实世界中的危害。
在能够用于提升安全性的场景中,这些能力和技术需要可用且更易于使用。我们的网络安全可信访问试点计划让个人和组织能够继续使用模型开展潜在高风险的网络安全活动,而不受干扰。
从事网络安全相关工作或类似活动的开发者和安全专业人员,其请求可能会被自动检测系统误判,并因此被重新路由至 GPT-5.2 作为备用模型。我们预计只有极少部分流量会受到缓解措施的影响,并正在积极校准我们的政策和分类器。
最新的 Codex CLI alpha 版本包含请求被重新路由时的产品内消息提示。未来几天内,所有客户端都将支持此消息提示。
受缓解措施影响的账户可以通过加入下方的网络安全可信访问计划,重新获得对 GPT-5.3-Codex 的访问权限。
我们认识到,加入网络安全可信访问计划可能并不适合所有人。因此,随着这些缓解措施的扩展以及网络安全韧性的不断加强,我们计划在大多数情况下从账户级安全检查转向请求级检查。
网络安全可信访问
Section titled “网络安全可信访问”我们正在试点“可信访问”,让开发者能够保留高级能力,同时我们继续为全面开放使用校准政策和分类器。我们的目标是让极少数用户需要加入网络安全可信访问计划。
要使用模型开展潜在高风险的网络安全工作:
- 用户可以在 chatgpt.com/cyber 验证身份。
- 企业可以通过其 OpenAI 代表,为整个团队默认申请可信访问。
可能需要访问网络安全能力更强或限制更少的模型,以加速合法防御工作的安全研究人员和团队,可以在我们的仅限受邀计划中表达兴趣。拥有可信访问权限的用户仍必须遵守我们的使用政策和使用条款。
合法活动或非网络安全活动偶尔可能会被标记。发生重新路由时,响应模型将显示在 API 请求日志中,并通过 CLI 中的产品内通知显示;很快,所有界面都将支持此功能。如果你遇到认为不正确的重新路由,请通过 /feedback 报告误报。