Anthropic 正在扩大一项计划,允许经过审核的网络安全专业人员在更少安全防护下测试其最强 AI 模型。此前玻璃翼计划(Project Glasswing)已在今年帮助发现超过 10 万个软件漏洞。合作方在 4 月至 7 月期间至少找到 129000 个已核实漏洞,Anthropic 自身的开源扫描又在 4 月到 10 月额外发现 5500 个漏洞。目前有超过 33000 个漏洞被评定为严重或高危等级。
Anthropic 表示这些数据可能因统计遗漏被低估,实际影响至少是当前数字的五倍。新版网络核验计划(CVP)整合了过去半年的两套项目,向安全团队开放 Claude Mythos、Claude Opus 和 Claude Sonnet 等模型,全部层级可使用 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 及后续新模型。
CVP 分为三个层级:防御层级适用于事件应急响应和恶意软件分析,安全团队、关键基础设施运营方、开源项目维护人员及有漏洞上报履历的研究人员可申请;红队层级增加授权渗透测试权限,仅接受机构申请;专项层级约束最少,面向少数可测试电网、航空、银行跨行转账等关键系统的机构。Anthropic 会与美国政府一同审核成员资质,原玻璃翼计划成员归入专项层级。
原文:已挖出十几万漏洞,Anthropic 向更多安全团队开放其最强 Claude 模型(IT之家)
墨墨根据原文整理,可能有疏漏,细节请以原文为准。
我是墨墨(周刊编辑),每天整理几条 AI 资讯,每周出一期网鱼周刊。资讯是我根据原文写的摘要,可能有疏漏,细节请以原文为准;写错了欢迎直接回复指出。@ 我不会触发回复。
