">

Anthropic 扩展 Cyber Verification Program:把高级网络能力按三档开放给经审核的安全团队

Anthropic 于 2026 年 10 月 6 日宣布扩展其 Cyber Verification Program(CVP),把过去分别运行的 Project Glasswing 与 CVP 合并为一个三档访问的计划:Defense Access、Red Team Access 与 Specialized Access。通过审核的安全团队可获得拦截更少、网络能力更强的 Claude 模型访问权限,官方同时公布了分层拦截效果的评估结论。

这次发布的是什么

Anthropic 于 2026 年 10 月 6 日在官网新闻页宣布,推出扩展版的 Cyber Verification Program(CVP),向符合条件的安全专业人员开放更强的网络能力与更少的拦截分类器。这次调整把此前并行运行的两个计划——面向关键软件防护组织的 Project Glasswing 与面向已审核安全团队的 CVP——合并为一套分层服务。新的三档分别是 Defense Access(防御)、Red Team Access(红队)与 Specialized Access(专项)。官方说明,三档均包含当时能力较强的若干模型,包括 Claude Opus 5.5、Claude Sonnet 5.5 与 Claude Mythos 5.1,以及后续推出的新模型。对个人研究者与安全厂商之外的组织来说,这是一条绕开通用模型保守拦截、合法开展漏洞研究的申请通道。

可用性与限制

  • 需要申请:不是自助开通,各档有不同的审核要求与安全控制,官方称 Defense Access 的申请在数日内回复,Red Team Access 需数周。
  • 主体限制:Red Team Access 目前只面向组织,个人研究者不可申请;Defense Access 则接受有漏洞披露记录的个人研究者。
  • 保留拦截:即使在高档位,官方声明对可能造成物理伤害或大规模破坏的行为仍保留实时拦截,例如部署勒索软件、破坏物理系统、对高风险安全系统做渗透测试。
  • 数据留存:加入计划的组织默认需要数据留存以供滥用监测;官方称零数据留存方案要等 Enterprise Frontier Safeguards(EFS)在当年秋季稍晚可用,在此之前使用 Claude Fable 5.1 或 Claude Mythos 5.1 且已开通零数据留存的组织可沿用该设置。
  • 地域与合规:Specialized Access 的审核官方称与美国政府协作进行;具体适用性与合规要求以官方申请条款为准。

主要功能

  • Defense Access:面向安全运营、事件响应、恶意软件逆向、漏洞分析与验证等防御性工作。
  • Red Team Access:在防御用途之外,增加已授权的渗透测试与红队演练。
  • Specialized Access:拦截最少,面向被授权测试可能影响人身安全或市场运行的系统的组织。
  • 三档均包含 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 及后续新模型。
  • 原 Project Glasswing 成员直接转入 Specialized Access,现有模型无需重新审批。
  • 审核期间,Red Team Access 申请人先被纳入 Defense Access 档位。

技术原理

官方把这件事拆成「能力」与「拦截分类器」两个变量:通用模型上的网络类请求会被保守的安全分类器挡下,而 CVP 的做法是按申请者的身份、用途与审核级别,调整分类器的触发阈值,而不是改变底层模型。为了验证分层是否真的有效,Anthropic 用 CyScenarioBench——一个衡量模型在真实约束下规划并执行多阶段网络行动的评测——在各档设置下跑了对照:每档 10 个挑战、每个挑战 5 次尝试。官方公布的结论是,未接入 CVP 时任务在首个提示就被阻断;Defense Access 档下绝大多数尝试仍在某一步被拦截、少数成功;Red Team Access 档下未发生拦截,且完成率与不加防护时的表现基本一致。需要说明的是,这些是厂商自评结果,具体数字与评测设计以官方公告为准。

实际体验

可复现的验证步骤:先确认你所处的档位需求——只做防御性工作(告警分诊、漏洞验证、恶意软件分析)选 Defense Access;需要对外授权渗透测试选 Red Team Access;测试对象涉及航空、电网、电信、同业转账或政务系统则属 Specialized Access 范围。准备组织资质材料后通过官方公告中的申请入口提交,并在等待期间用通用模型跑一遍你的常规流程,记录哪些步骤被拦截,作为申请通过后对比的基线。审核结果与适用范围以 Anthropic 的回复为准。

项目地址与获取方式

官方公告与申请入口:https://www.anthropic.com/news/cyber-verification-program 。页面内提供了各档申请链接与 EFS 意向登记表单。请通过官方渠道提交,避免经由第三方代办。

适合谁用

  • 企业安全运营与事件响应团队,尤其是需要模型协助做漏洞验证与恶意软件逆向的。
  • 政府与关键基础设施运营方(医院、市政公用事业等)的防御团队。
  • 有授权渗透测试需求的企业内部红队与安全服务厂商;Specialized Access 面向航空、电网、电信等受审对象。
  • 什么人不必用:只做常规代码审查、已知问题修补与告警分诊的团队,通用模型已足够,无需申请。

常见问题

这次和原来的 Project Glasswing 是什么关系?

是合并。官方说明,此前 Glasswing 面向防护最关键软件的组织开放 Claude Mythos,CVP 面向已审核安全团队开放降低防护的 Opus 与 Sonnet;现在两者并入一个扩展后的 CVP,Glasswing 现有成员转入 Specialized Access 档,当前模型无需重新审批。

审核要多久?

官方称 Defense Access 的申请目标是数日内回复,Red Team Access 因资质与安全控制要求更高,预计需要数周;审核期间申请人会被先纳入 Defense Access 档位。

高权限档位是不是就没有限制了?

不是。官方明确,即使在高档位,对可能造成物理伤害或大规模破坏的行为仍保留实时拦截,例如部署勒索软件、破坏物理系统、对高风险安全系统做渗透测试。档位的差别在于允许的授权测试范围。

参与后数据会被留存吗?

官方说明,加入计划的组织默认需要数据留存,以便监测网络滥用;等 Enterprise Frontier Safeguards 在当年秋季稍晚可用后,符合条件的组织可在自己控制的云环境中存储数据。在此之前,使用特定模型且已开通零数据留存的组织可沿用该设置。

相关工具与内容

Related
快讯 1 小时前

EmbeddingGemma 2 发布:7.4 亿参数的端侧多模态嵌入模型,文本、图像、音频、视频共用一个向量空间

Google DeepMind 于 2026 年 10 月 6 日在官方博客发布 EmbeddingGemma 2,把上一代的纯文本嵌入扩展到代码、图像、视频与音频,统一映射到同一个嵌入空间。模型基于 Gemma 4 架构、7.4 亿参数、Apache 2.0 许可,面向手机与浏览器等端侧场景,官方称其支持可裁剪的模块化编码器与 Matryoshka 向量降维。

前沿快讯 1 阅读
快讯 1 小时前

Diffusers v0.41.0 发布:接入 Qwen-Image 2.1,并改用围绕新模型的发版节奏

Hugging Face 的扩散模型库 Diffusers 于 2026 年 10 月 6 日发布 v0.41.0,主线是把 Qwen-Image 2.1 接入 Diffusers,支持文生图、图像编辑、原生透明通道与 LoRA 训练。官方同时宣布改用与 Transformers 一致的发版策略:次版本围绕新模型集成组织,补丁版本只做修复。

前沿快讯 2 阅读

继续阅读:ComfyUI v0.39.0 发布:新增离线与关闭合作节点开关,一批第三方模型节点同步上线 · Diffusers v0.41.0 发布:接入 Qwen-Image 2.1,并改用围绕新模型的发版节奏

关于本文:本站文章由编辑部独立撰写,评测口径与免责说明见关于我们。想继续找工具,可从分类导航按场景浏览,或回首页搜索。

链接已复制