Anthropic扩容网络安全计划 半年揪出13万漏洞
Anthropic 周二宣布扩展其「网络安全验证计划」(Cyber Verification Program,CVP),把过去半年分别运行的两个项目——面向关键软件防护机构的 Project Glasswing 和面向经审核安全团队的原 CVP——合并为一套三档权限体系,向通过审查的安全从业者开放安全限制更少的 Claude 模型。
扩容的底气来自过去半年的「战绩」。据官方披露,Glasswing 合作伙伴在 4 月至 7 月间发现并验证了至少 12.9 万个软件漏洞;Anthropic 自家的开源扫描在 4 月至 10 月又找出 5500 个,其中超过 3.3 万个被评定为严重或高危。Anthropic 强调这组数字很可能大幅低估——数据只来自部分伙伴的问卷,真实影响至少是已披露数字的 5 倍。多家合作机构表示,借助 Claude Mythos 模型,漏洞发现速度比纯人工提前了数月甚至数年。

新的 CVP 分为三档:Defense Access 面向事件响应、恶意软件分析等防御性工作,安全团队、关键基础设施运营方、开源维护者和有漏洞报告记录的个人研究者均可申请;Red Team Access 增加授权渗透测试和红队演练,仅限组织申请;限制最少的 Specialized Access 只留给极少数经美国政府协同审查的机构,用于测试电网、飞行控制系统、银行间转账基础设施这类「出事就是大事」的系统——现有 Glasswing 成员将直接转入这一档。
三个档位均可使用 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 及后续新模型,服务通过 Claude 平台、谷歌云 Vertex AI 和 Microsoft Foundry 提供。Anthropic 同时保留了数据留存要求,用于监测网络滥用行为。
今年 4 月 Claude Mythos 预览版发布时,业内曾担忧「AI 会在人类打好补丁之前先学会入侵」。Anthropic 的回应思路很明确:与其把最强模型锁死,不如让经过审查的防御者先用上。安全能力的攻防天平会因此向哪边倾斜,仍有待观察。
编译自 Reuters,原标题:"Anthropic expands AI security program, granting vetted teams broader model access"