Anthropic News · 2026/10/6 00:00:00
Anthropic 扩展网络验证计划,分级开放高级安全能力
Anthropic 推出扩展版网络验证计划(CVP),为合格的安全专业人员提供三个访问层级。该计划允许申请者在特定条件下使用 Claude Opus 5.5 等模型的高级网络能力及降低的拦截分类器,以平衡网络安全的双刃剑特性。
报道全文原始报道全文
本文目录2 个章节
我们即将推出全新扩展版的网络验证计划(Cyber Verification Program,简称 CVP),该计划为符合条件的安全专业人员提供高级网络能力及放宽限制的拦截分类器。目前,该计划包含三个访问层级,允许安全团队根据其工作性质申请最合适的访问级别。每个层级均可访问我们性能最强的模型,包括 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1,以及未来推出的新模型。感兴趣的客户可在此申请。
网络安全本质上具有双重用途:使安全团队能够发现并修复漏洞的能力,同样也可能被恶意行为者利用以实施攻击。因此,我们的通用可用模型(如 Claude Opus 5.5、Claude Fable 5.1 和 Claude Sonnet 5.5)配备了保守的网络安全防护措施,会拦截大多数网络相关操作。此举旨在限制恶意行为者利用我们的模型从事有害活动,同时我们也在持续努力降低安全编码场景中的误报率。
然而,防御方也需要获得最佳工具和最强能力来保障其系统安全。在过去六个月中,我们通过两个项目提供了受信任的访问权限:Project Glasswing 和 CVP。前者为负责保护最关键软件的一组组织提供了对 Claude Mythos 的访问权限;后者则为经过审核的安全团队提供了在 Claude Opus 和 Claude Sonnet 模型上放宽安全防护措施的访问权限。
现在,我们将这些项目整合为一个扩展的服务方案,旨在让更多安全组织能够获得保护其系统所需的能力。
新的访问层级
更新后的访问层级根据安全专业人员网络工作的范围,向其开放特定的模型能力。每个层级都有不同的验证要求和安全控制措施。
防御访问权限(Defense Access) 适用于防御性工作,包括安全运营中心(SOC)和事件响应任务、恶意软件逆向工程,以及漏洞分析与验证。符合资格的机构示例包括:负责保护其自有或维护系统的安全团队(来自企业、非营利组织、大学及政府机构);任何规模的关基设施运营商(如区域医院或市政公用事业公司);规模较小的安全公司;开源项目维护者;以及有已报告漏洞记录的独立研究人员。
我们预计许多开展防御性网络安全工作的机构将符合此层级的资格。我们的目标是在几天内对申请作出回应。
红队访问权限(Red Team Access) 在上述防御用途的基础上,增加了经授权的渗透测试和红队演练。符合资格的机构示例包括:内部红队、政府红队以及安全和渗透测试公司。此层级的机构只能针对其获得授权测试的系统执行对抗性测试,包括关键行业的 IT 系统。用户仍会经历实时拦截机制,以阻止可能造成人身伤害或大规模中断的行为,例如部署勒索软件、破坏物理系统或对高风险安全系统进行渗透测试。
鉴于更高的资格要求和安全控制措施,我们预计此层级的申请审查需要数周时间。在审查其红队访问权限申请期间,符合条件的机构将被纳入“防御访问权限”层级。目前,此层级仅面向机构开放;独立研究人员不符合资格。
专项访问权限(Specialized Access) 具有最少的网络限制,仅保留给少数经过验证的机构,这些机构获准测试可能影响人们生命或扰乱市场的安全系统,例如飞行操作系统、电网、电信网络、银行间转账基础设施以及政府行政网络。
对于此层级,我们目前与美国政府合作,对每个机构进行深入审查。Project Glasswing 的现有成员将过渡到此层级,且无需为当前模型重新审批。
我们普遍可用的模型仍可继续用于代码审查、修补已知问题、在自有源代码中发现漏洞以及安全警报分类等任务。
加入该计划的组织必须保留数据,以便我们监控网络滥用行为。今年秋季晚些时候,Enterprise Frontier Safeguards(EFS)——一种将零数据保留的隐私性与强大防护措施相结合的新解决方案——上线后,符合条件的组织将能够在其控制的云基础设施中存储数据。在 EFS 可用之前,拥有 Claude Fable 5.1 或 Claude Mythos 5.1 访问权限且采用零数据保留的组织,也可以使用支持零数据保留的 CVP。如需登记对 EFS 的兴趣,请填写此表单。
下文我们将概述各 CVP 访问级别可用的功能,以及安全和隐私控制要求:

Cyber Verification Program(CVP)层级概览。
测试各层级的有效性
为了评估 CVP 防护措施的有效性,我们在针对不同 CVP 层级调整了安全护栏的情况下,让 Claude Opus 5.5 通过了 CyScenarioBench 测试——这是一项衡量模型能否在现实约束下规划和执行多阶段网络攻击行动的评估基准。由于该评估涉及复杂的交互式攻击场景,我们预计 Claude 在通用可用模型和 Defense Access(防御访问)层级中会遭遇大量拦截,而在 Red Team Access(红队访问)和 Specialized Access(专业访问)层级中则不会有任何拦截。
在每个访问层级中,针对 CyScenarioBench 的 10 个挑战中的每一个进行五次尝试后,我们发现:
- 在没有 CVP 访问权限的情况下,所有任务均在第一个提示词处被拦截;
- 在 Defense Access 层级中,50 次试验中有 46 次在挑战过程中的某个时刻被拦截,其余四项任务成功完成;
- 在 Red Team Access 层级中,未发生任何拦截,Claude Opus 5.5 成功完成了 50 项任务中的 34 项——这实际上等同于该模型在未应用任何安全防护措施的情况下在此评估中取得的 67.6% 成功率(代表 Specialized Access 层级)。
这些评估结果让我们有信心能够安全地向更广泛的防御者提供先进的网络能力,从而扩展我们从 Project Glasswing 开始的防御工作。我们将持续优化基于层级的分类器。

在 CyScenarioBench 基准测试中,我们的安全防护措施在 Claude Opus 5.5 的“防御访问”(Defense Access)层级上拦截了 50 项任务中的 46 项;而在“红队访问”(Red Team Access)层级上,Claude Opus 5.5 未拦截任何任务,并完成了 50 项中的 34 项——这一完成率与未启用安全防护措施时相同。
赋予防御方优势
通过 Project Glasswing 项目,我们发现 Claude Mythos 模型显著提升了组织识别其系统中漏洞的能力。在该项目的支持下,我们的合作伙伴在 2026 年 4 月至 7 月期间发现了至少 129,000 个经过验证的软件漏洞。此外,通过我们自身的开源扫描工作,我们在 2026 年 4 月至 10 月期间又发现了 5,500 个经过验证的软件漏洞。在这些已验证的漏洞中,迄今已有超过 33,000 个被评定为严重或高危级别。这很可能是一个低估的数字,因为它仅基于部分 Glasswing 合作伙伴的调查数据。因此,我们预计实际影响至少是此数据的五倍。
当被问及如果没有 Claude Mythos 模型,他们需要多长时间才能发现同等数量的漏洞时,多家合作伙伴表示,这些模型将他们的漏洞发现速度提高了数月甚至数年。欲了解更多详情,请阅读来自 Booz Allen 和 Comcast 合作伙伴的经验分享。

这些数据代表了该项目对第三方代码影响的最低限度估计,因为它们仅基于 33 份合作伙伴报告以及 Anthropic 开源合作的部分数据。数据局限性包括:各组织采用了不同的漏洞分类(triaging)方法,且不到 50% 的合作伙伴披露了补丁修复数量,通常是因为他们的修复工作仍在进行中,因此补丁率被显著低估。
[注:本文篇幅超长,以上为核心前篇精译,后续内容保留原文呈现]
The changes we’re making to our Cyber Verification Program today are intended to extend the impact of Project Glasswing to a much larger number of cyber defenders. We’re also continuing our efforts to help secure open-source software and critical infrastructure. In the coming weeks, we’ll share more about this work and what we’ve learned as we continue to work to give defenders a permanent advantage.
Apply for access
Interested organizations can apply to CVP here. As part of the application process, we will verify all applicants and request proof of the required security controls for the relevant access tier. Existing CVP members will keep their current settings for previous models and will be automatically evaluated for access to Claude Opus 5.5, Claude Sonnet 5.5, and Claude Mythos 5.1 through the updated program. Admins will need to assign access to specific workspaces by following these steps.
CVP is available on the Claude Platform, Google Cloud’s Vertex AI, and Microsoft Foundry. CVP is only available on Amazon Bedrock for customers eligible for Enterprise Frontier Safeguards.
If you’re blocked on work you think your tier should allow, you can report it here. Full details on each tier can be found in our Help Center.