OpenAI 已正式推出面向网络安全场景的 GPT-5.5-Cyber,并将其纳入 Daybreak 网络防御计划。该模型主要用于帮助安全团队更快发现并修复软件漏洞。与之形成对比的是,Anthropic 的 Mythos 5 目前仍处于下线状态,原因是美国政府此前以国家安全为由实施紧急出口限制。

CyberGym成绩升至85.6%

OpenAI 6 月 22 日宣布全面发布 GPT-5.5-Cyber。按照加州大学伯克利分校开发的 CyberGym 基准,这一模型在 188 个开源项目、1507 个已知软件漏洞的受控测试中取得 85.6% 的成绩。

同一榜单上,Anthropic 的 Mythos 5 得分为 83.8%,面向更广泛用户开放的 Claude Opus 4.7 为 73.1%。从分数差距看,两家模型并未拉开特别大的距离,但市场关注点更多落在两家公司完全不同的上线路径上。

Anthropic模型仍未恢复

Anthropic 的 Mythos 5 和 Fable 5 于 6 月 12 日被下线。报道显示,特朗普政府当时发布紧急出口管制指令,理由是相关模型存在国家安全风险。

政府提到的问题之一,是模型可能被越狱后绕过原有限制。由于 Anthropic 无法大规模可靠核验用户国籍,公司最终选择在全球范围内停用这两款模型,而不是只针对部分地区限制访问。

Anthropic 此前也曾多次强调 Mythos 属于能力很强、同时风险较高的前沿模型,并在发布材料中提到,如果缺少足够限制,其网络安全能力可能被滥用。几天后,这一风险讨论很快转化为实际监管行动。

OpenAI扩大合作范围

在 Anthropic 与美国商务部继续沟通之际,OpenAI 正在扩大 Daybreak 计划的外部合作。公开信息显示,该计划已与澳大利亚、加拿大、法国、德国、日本、韩国以及欧盟相关机构建立网络安全合作关系。

  • 28 家安全公司加入合作项目
  • 包括 CrowdStrike、Cisco、Cloudflare
  • 能力接入后提供给审核客户使用

根据 OpenAI 披露,其 Codex Security 工具自 3 月上线以来,已扫描超过 3000 万次代码提交,覆盖约 3 万个代码库,并记录了超过 50 万个已修复漏洞。公司同时推出“Patch the Planet”计划,目标是帮助修复被广泛使用的开源项目漏洞。

仍只向验证用户开放

不过,GPT-5.5-Cyber 并未面向公众开放。OpenAI 表示,该模型目前只提供给经过验证的安全专业人士使用,并在上线前与美国联邦机构完成了预部署测试。

报道提到,参与测试的机构包括美国人工智能标准与创新中心,以及国家网络主任办公室。与 Anthropic 相比,OpenAI 的做法并非放松限制,而是先在受控范围内推进,并提前与政府完成协调。

截至 6 月 23 日,Anthropic 的 Fable 5 和 Mythos 5 仍未恢复上线,官方也尚未给出明确恢复时间。