Anthropic 给 Claude 开了「红队通行证」。
不是谣言,是 Anthropic 官方 10 月 6 日博客:Cyber Verification Program(CVP)升级,把原来的 CVP 和 Project Glasswing 合并成三档权限。通过审核的安全团队,可以在 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 上拿到更少的安全拦截。
1️⃣ 三档怎么分
Defense Access:事件响应、恶意软件逆向、漏洞分析。公司安全团队、开源维护者、有漏洞上报记录的个人研究者都能申请,官方说几天内回复。
Red Team Access:在上面基础上,加上授权渗透测试和红队测试。只对组织开放,审核要几周。
Specialized Access:拦截最少,只给能测电网、飞控、电信网络、银行间转账这类关键系统的机构,官方写明会和美国政府一起逐家深度审核。Glasswing 老成员直接进这一档。
2️⃣ 官方自己跑的测试
用 Claude Opus 5.5 跑 CyScenarioBench,10 个挑战、每档各 50 次:
没有 CVP,50 次全在第一个 prompt 就被拦;
Defense 档,50 次里 46 次中途被拦;
Red Team 档,0 次被拦,完成 34 次,跟完全不设限时 67.6% 的成功率基本一样。
勒索软件、破坏物理系统这类操作,任何档位依然实时拦截。
3️⃣ Glasswing 的成绩单
官方披露:合作方 2026 年 4 月到 7 月发现至少 12.9 万个已验证漏洞,Anthropic 自己的开源扫描 4 月到 10 月又找到 5500 个,其中超过 3.3 万个被评为高危或严重。官方也说这是基于部分合作方数据,偏低估。
我的看法:
AI 安全这件事,Anthropic 现在的打法是「默认锁死,按身份解锁」。普通用户的模型继续保守,真干防守的人拿 KYC 换火力。这跟交易所分级 KYC 一个逻辑,只是这次解锁的是攻防能力。
对 Web3 来说更直接。合约审计、交易所和钱包的安全团队,过去用通用模型经常被拦得没脾气,现在有了正规申请通道。问题也很明显:防守方能用,攻击方迟早也会想办法用。所以数据留存是强制的,官方要监控滥用。
只筛选不教育:做 DeFi 安全或者交易所风控的团队,这个值得去看一眼申请条件。其他人记住一句话就行,AI 找漏洞的速度已经是按「月和年」在压缩了,你的合约别再裸奔。
来源:Anthropic 官方博客《Expanding the Cyber Verification Program》(2026-10-06);BlockBeats/动察 Beating 快讯。
以上为资讯整理,不构成投资建议。