ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
Anthropic 扩展网络核验计划:三档权限向安全团队开放强模型

Anthropic 扩展网络核验计划:三档权限向安全团队开放强模型

AI资讯 • Admin • • 8 次浏览

Anthropic 在 2026 年 10 月 6 日通过官方新闻页宣布,推出扩展版网络核验计划(Cyber Verification Program,简称 CVP),把此前分开运行的 Project Glasswing 与原 CVP 合并成一套分档准入体系:通过审核的安全专业人员,可以使用拦截更少的 Claude 强模型做防御和授权测试,包括 Claude Opus 5.5、Claude Sonnet 5.5 与 Claude Mythos 5.1。

先说清为什么需要单独开一道门

网络安全能力天然是两用的:能帮防守方找漏洞的模型,也能帮攻击方利用漏洞。因此 Anthropic 面向公众的通用模型装着偏保守的网络安全护栏,大多数网络攻防类请求会被直接拦下,代价是正经做防御的人也用不上最强的能力。过去半年,Anthropic 用 Project Glasswing 和原 CVP 两条线给受信任的组织开小门:前者面向守护关键软件的机构,后者面向通过审核的安全团队。这次扩展,就是把两条线并成一扇分档的门。

三档权限分别放行什么

第一档是防御访问(Defense Access),覆盖安全运营、事件响应、恶意软件逆向和漏洞分析验证。申请面相当宽:企业、非营利组织、大学和政府机构的安全团队,医院、市政公用事业这类关键基础设施运营方,小型安全公司,开源项目维护者,以及有漏洞报告记录的个人研究者都在预期之列,Anthropic 称申请通常几天内回复。

第二档是红队访问(Red Team Access),在防御用途之上再放行授权渗透测试和红队演练,只面向组织,个人研究者不能申请。这档审核要几周,等待期间先按防御档开通。红队也不是无限放行:可能造成人身伤害或大规模破坏的操作仍会被实时拦截,例如投放勒索软件、破坏物理系统。

第三档是专项访问(Specialized Access),拦截最少,只留给极少数经深度审核的机构,针对的是可能影响人身安全或市场秩序的系统,例如飞行操作系统、电网、电信网络和银行间转账基础设施,审核与美国政府协作进行。原 Project Glasswing 成员直接平移到这一档。

护栏分档之后,拦得住吗

Anthropic 公布了一次对照测试的结果:用包含 10 个多阶段网络攻防场景的 CyScenarioBench 评测 Claude Opus 5.5,每个场景在每档下各试 5 次。没有 CVP 权限时,全部任务在第一句提示就被拦下;防御档下,50 次尝试有 46 次在中途被拦,4 次完成;红队档下一次拦截都没有,50 次里完成了 34 次,与完全不加护栏时的完成率基本一致。

这组数字想说明的是:分档不是把护栏拆掉,而是把拦截强度和申请人的审核深度绑在一起。另一个支撑数据来自 Project Glasswing:2026 年 4 月到 7 月,合作机构用 Claude Mythos 模型找出了至少 12.9 万个经确认的软件漏洞。

需要留意两个约束。一是参加计划的组织默认要接受数据留存,以便 Anthropic 监测滥用;兼顾零数据留存的新方案 Enterprise Frontier Safeguards 预计今年秋季晚些时候才上线。二是这套体系目前完全由 Anthropic 自行审核、自行分档,标准是否经得起规模化申请的检验,要等更多组织真正走完流程才知道。对安全团队来说,眼下的实际问题更具体:先对照三档的用途边界,确认自己的工作落在哪一档,再准备申请。

推荐工具

更多