美国商务部解除对 Anthropic 两款新模型的出口限制后,Claude Fable 5 将于周三恢复全球访问,覆盖 Claude.ai、Claude Platform、Claude Code 和 Claude Cowork。此前,这一限制曾导致公司自 6 月 12 日起在全球范围下线相关模型。
Mythos 5 仍未全面恢复
Anthropic 表示,能力更强的 Claude Mythos 5 目前仍只向经过审核的合作伙伴开放,暂不恢复面向全部用户的访问。
这次下线源于一份越狱测试报告。亚马逊研究人员发现,Fable 5 的安全护栏可被绕过,模型会识别软件漏洞,并在个别情况下生成可用于利用漏洞的代码。
由于当时的出口限制适用于全球范围内的外国公民,而 Anthropic 无法实时逐一核验用户国籍,公司最终选择对所有用户停用两款模型,以避免违规风险。
新安全分类器拦截超 99% 绕过尝试
Anthropic 在说明中称,公司已重新训练一套安全分类器,专门识别这次披露的越狱手法。按其说法,新系统可拦截超过 99% 的相关尝试。
如果 Fable 5 的请求被系统标记,平台会自动将请求切换至 Claude Opus 4.8,并向用户发出提示。美国商务部下属的 AI 标准与创新中心审查了新旧防护措施后,认为其强度“非常高”。不过,Anthropic 也承认,更严格的过滤会带来更多误报。
云端部署恢复时间更晚
在访问安排上,Pro、Max、Team 以及部分 Enterprise 用户可在 7 月 7 日前,使用最多占每周额度一半的 Fable 5 服务。此后,访问方式将改为按使用积分计费。
Anthropic 还表示,AWS、Google Cloud 和 Microsoft Foundry 上的可用性将“尽快”恢复,这意味着依赖云端托管部署的企业客户,恢复时间会晚于 Claude 自有应用。
在两款模型停用期间,竞争对手趁机推进相关产品。报道提到,OpenAI 的 GPT-5.5-Cyber 在加州大学伯克利分校的 CyberGym 基准测试中,以 85.6% 的成绩超过 Mythos 5 的 83.8%。
Anthropic拟与科技公司共建分级标准
Anthropic 还表示,正与亚马逊、微软和谷歌起草一套越狱严重程度分级框架,评估维度包括能力提升幅度、适用范围、武器化难度和可发现性。
同时,该公司承诺,未来会在前沿模型公开发布前,更早向政府提供模型及其安全措施,以便进行测试。Anthropic 也已上线新的 HackerOne 项目,用于收集研究人员提交的 Fable 5 绕过案例。
