编辑优先级 60/100
Anthropic 报告称,GLM-5.3 已具备较强的漏洞利用能力:在 ExploitBench 的 410 次尝试中成功 50 次,Claude Mythos Preview 成功 56 次。报告还称,研究人员通过预填思考内容,使模型在模拟测试中继续执行攻击的比例达到 92%,并呼吁开展独立安全测试。
推荐理由:报告同时给出漏洞利用测试结果和模拟测试中的防护绕过比例,为评估模型能力与滥用风险提供了具体依据。
同一事件,精选展示《Anthropic 评估 GLM-5.3:可自主构建漏洞利用链》