TechTrends360 科技前沿

聚焦全球科技前沿资讯:AI、芯片、互联网大厂动态,每日更新

人工智能

Anthropic三级开放资安模型:4个月找出12.9万漏洞

2026年10月6日,Anthropic宣布推出扩大版网络安全验证计划(Cyber Verification Program,简称CVP),将此前两个独立的资安准入项目合并为统一的三级授权体系,向通过审核的安全专业人员开放Claude Opus 5.5、Sonnet 5.5与Mythos 5.1的高级网络安全能力,并大幅降低模型的网络安全类请求拦截。根据公司公布的数据,此前的合作伙伴在2026年4月至7月短短4个月内,已找出至少12.9万个经过验证的软件漏洞。

三级授权:防御、红队、特殊准入

新的CVP把资安能力按用途分为三层,每一层都包含Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1以及未来的新模型,但模型允许执行的网络安全请求范围逐级放宽:

1. 防御层(Defense Access)

面向安全运营中心(SOC)值守、事件应急响应、恶意软件逆向工程、漏洞分析与验证等防御性工作。申请主体覆盖面最广,包括企业安全团队、非营利组织、高校、政府部门、关键基础设施运营商、小型安全公司、开源项目维护者,以及有漏洞披露记录的个人研究者。审核周期一般为数天。Anthropic内部评测显示,在该层级下,50项复杂网络安全任务中仍有46项会被拦截,防御方只能使用被明确允许的防御能力。

2. 红队层(Red Team Access)

在防御用途基础上,额外允许开展授权渗透测试与红队模拟攻击。该层级仅限组织申请,不对个人开放,审核流程需要数周。在Anthropic的CyScenarioBench内部评测中,红队层对50项任务实现零拦截,Claude Opus 5.5成功完成了其中34项——与无任何防护时的表现相当(67.6%成功率)。需要说明的是,这份评测由Anthropic自行运行,尚未经过第三方独立验证。

3. 特殊层(Specialized Access)

这是限制最少、审核最严的一层,仅面向获授权测试安全关键系统的极少数组织,例如飞行操作系统、电网、电信网络、银行间转账系统和政府网络。申请将由Anthropic与美国政府共同进行深入审查。原Project Glasswing项目的成员将自动转入该层级,无需重新审批。

数据留存方面,Anthropic要求默认保留使用数据以便监控滥用行为;已获得Fable或Mythos零数据留存豁免的组织可暂时延续该豁免。公司还预告了一项名为Enterprise Frontier Safeguards的服务,允许符合条件的组织将数据保留在自身控制的基础设施内。

4个月找出12.9万个漏洞

此次扩张的底气来自此前的实测成果。Anthropic表示,Project Glasswing的合作伙伴在2026年4月至7月间,累计找出至少12.9万个经过验证的软件漏洞,其中超过3.3万个被评为严重或高危级别。公司自己的开源扫描在4月至10月间又额外发现了5500个漏洞。安全公司Booz Allen和Comcast还提供了用Claude Mythos扫描自有代码库的案例研究。

值得注意的是,根据VulnCheck的数据,在300个被Anthropic标记的漏洞中,只有2个(0.67%)在野外被实际利用过——说明AI发现的多数漏洞尚未被攻击者武器化,防御方仍有时间窗口。Anthropic同时坦言,由于合作伙伴数量有限,上述数字很可能被低估,实际影响至少是公布数字的5倍。

背景:安全能力的“两用性”困境

过去半年,Anthropic实际上在并行运行两个资安准入项目:Project Glasswing向保护关键软件的组织提供Claude Mythos访问权限,原CVP则向通过审核的安全团队提供拦截较少的Claude Opus与Sonnet版本。此次扩张把两者合并为统一入口。

Anthropic给出的核心理由是网络安全的“两用性”:能帮安全团队找到并修复漏洞的同一能力,也可能被恶意行为者拿去利用漏洞。因此,公司面向公众的模型(包括Opus 5.5、Fable 5.1、Sonnet 5.5)保留了保守的安全防护,会拦截绝大多数网络安全任务;普通用户仍可用公开模型进行代码审查、修复已知问题、审计自有源码漏洞和研判安全告警等常规工作。

换句话说,Anthropic的思路是从“一刀切拦截”转向“验证身份、分级授权”:不再让合法的防御方和红队被误伤,而是通过身份审核、用途限定和持续监控,把高级能力交给可信的人。这也是它与完全开放或完全封锁之间的第三条路。

影响与展望:AI安全能力走向“分级准入”

对安全行业而言,这意味着红队和防御团队首次能以合规方式使用顶级模型的完整能力。漏洞挖掘、渗透测试、恶意软件分析的效率曲线可能因此改变——过去需要大量人工的重复性分析工作,有望被AI大幅加速。对于常年缺人的企业安全团队,这是一个实质利好。

风险同样真实。放宽限制的模型一旦被滥用,后果可能比普通模型严重得多。Anthropic的护栏是身份验证、数据留存监控和用途审批,但这些机制能否挡住有组织的滥用,还有待时间检验。此外,CyScenarioBench的评测数据来自公司自测,第三方独立验证尚未出现,对“零拦截”结论应保持一份审慎。

更大的趋势在于,AI能力与安全治理的关系正在从“全面锁死”走向“分级准入”。当模型能力强到足以成为攻防双方的战略资产时,简单的开关式管理已经不够用,分层、分级的精细化治理或将成为大模型安全能力开放的主流范式。Anthropic这一步,很可能只是开始——其他大模型厂商是否跟进、各自的分级标准如何划定,将是接下来值得观察的风向。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注