把最锋利的模型交到防守方手里,同时不让它变成攻击方的通用武器——这是 Anthropic 这次调整想回答的问题。
发生了什么
据 The Decoder 报道,Anthropic 正在扩大其 Cyber Verification Program(网络验证计划),让更多安全专业人士能够以更少的安全限制访问 Claude 模型,用途明确指向渗透测试、恶意软件分析和漏洞研究这三类工作。
Anthropic 同时披露了前身项目的一组数据:在 2026 年 4 月至 7 月期间,参与该项目的合作伙伴确认了至少 129,000 个漏洞,其中超过 33,000 个被评级为高危或严重级别。
为什么重要
这件事的关键不在“放宽限制”本身,而在于 Anthropic 选择用一套可验证的身份与用途审核机制,来替代一刀切的能力封锁。
前沿模型在安全领域天然具有双重用途:同一套代码理解与推理能力,既能用来审计自家系统、复现漏洞、分析样本,也能被用来寻找攻击面。主流厂商过去更倾向于收紧——在模型层面拒绝或模糊化处理相关请求,代价是真正的防守方也被挡在门外,渗透测试和安全研究常常要在低效的手工流程里绕路。
Cyber Verification Program 的思路是:把访问权限与“你是谁、你要做什么”绑定起来。通过验证的安全团队获得更少限制的模型访问,普通用户仍受原有安全策略约束。这实际上是把安全边界从模型权重前移到使用者的资质审核上。
那组漏洞数字是这套逻辑的论据。四个月、十几万个确认漏洞、三成以上为高危或严重——无论具体统计口径如何,它传递的信号是:当模型被允许在安全场景中完整发挥能力时,产出的量级已经很难被忽视。对 Anthropic 而言,这也是把“限制”从产品叙事中的成本项,转化为安全生态中的价值项。
影响与看点
对安全团队来说,最直接的变化是工具链的可用性。漏洞研究、样本分析这类工作高度依赖对代码和二进制的大规模理解,模型被过度拒答会显著拖慢节奏。限制放宽后,中小型安全团队有机会获得过去只有大厂内部工具才具备的分析效率。
对开发者与普通用户而言,需要留意的是边界并未消失,而是重新划分。验证机制意味着访问权限存在门槛与审查,滥用风险被转移到准入环节。这套机制能否规模化、能否抵御资质造假,是它能否被行业复制的关键。
值得关注的还有竞争维度。当一家厂商把“安全场景下的高能力访问”做成可审核的产品能力,其他前沿模型厂商大概率会跟进类似的分级访问方案,安全行业可能因此形成一套新的模型准入惯例。
一个克制的判断是:这次扩大的意义不在于 Claude 变“更少限制”,而在于厂商开始承认,安全防御是一个值得为之设计专门访问通道的正当用例。



