OpenAI 已向经过审查的网络防御者发布了 GPT-5.5-Cyber,为他们减少了专门安全工作流程的防护。
- OpenAI 的 GPT-5.5-Cyber 是其产品系列中最宽松的模型,仅向从事高级安全工作的经批准合作伙伴提供有限预览版。
- 经过审查的团队可以使用它进行错误查找、恶意软件分析和逆向工程,但恶意软件编写和凭据盗窃仍会受到阻止。
- 此次发布是在一个月前竞争对手 Anthropic 推出 Claude Mythos Preview 后推出的,引起了投资者和政府的关注。
OpenAI 于 5 月 7 日发布了 GPT-5.5-Cyber 的有限预览版,面向保护关键基础设施的安全专业人员。该公司将其描述为其网络安全产品线中最宽松的模型,旨在为一小群经过批准的合作伙伴提供专门的授权工作流程,并具有更严格的验证要求和帐户级控制。
网络特定版本使经过审查的团队能够更轻松地使用 OpenAI 的最新模型进行漏洞识别、补丁验证和恶意软件分析,而通用 GPT-5.5 中内置的防护栏会在这些工作流程中产生摩擦。
OpenAI 说:“GPT-5.5-Cyber 让一小部分合作伙伴可以研究专门的访问行为可能很重要的高级工作流程。”
防御者可以做什么和不能做什么
获得 OpenAI 最高级别的网络可信访问计划的防御者将收到 GPT-5.5 版本,该版本的护栏比公共模型更少,从而能够进行错误搜寻、恶意软件研究和攻击逆向工程。无论访问级别如何,凭证盗窃和编写恶意软件都会被阻止。
在早期测试期间,选定的合作伙伴使用 GPT-5.5-Cyber 来自动化和扩展基础设施系统上的红队演习,并验证高严重性漏洞。 OpenAI 计划在未来的技术深入研究中记录调查结果,作为负责任的披露流程的一部分。
英国人工智能安全研究所发布了针对 95 个狭窄网络任务的 GPT-5.5 评估。该研究所发现,至少自 2026 年 2 月以来,领先模型的基本任务已完全饱和,但它警告说,其测试并不能反映针对具有积极防御者和警报惩罚的防御严密的现实世界目标的性能。
竞争压力
推出该产品的一个月前,Anthropic 发布了 Claude Mythos Preview,这是一个以网络为中心的模型,即使几周前 Anthropic 已被五角大楼列入黑名单,但仍引起了投资者和特朗普政府高级成员的关注。
人工智能网络安全已成为正式的竞争前沿,两家公司都提出了谁控制人工智能进攻和防御工具以及当这些能力被滥用时谁承担责任的问题。
OpenAI 指出它还向美国人工智能标准与创新中心和英国人工智能安全研究所提供了早期模型 GPT-5.4-Cyber 的访问权限,以进行独立评估。标准 GPT-5.5 仍然是大多数防御者推荐的切入点。
