Anthropic 报告警告 GLM-5.3 的网络攻击能力及防护风险
Anthropic 报告称,GLM-5.3 已具备较强的漏洞利用能力:在 ExploitBench 的 410 次尝试中成功 50 次,Claude Mythos Preview 成功 56 次。报告还称,研究人员通过预填思考内容,使模型在模拟测试中继续执行攻击的比例达到 92%,并呼吁开展独立安全测试。
报告同时给出漏洞利用测试结果和模拟测试中的防护绕过比例,为评估模型能力与滥用风险提供了具体依据。
Anthropic 报告警告 GLM-5.3 的网络攻击能力及防护风险
Anthropic 报告称,GLM-5.3 已具备较强的漏洞利用能力:在 ExploitBench 的 410 次尝试中成功 50 次,Claude Mythos Preview 成功 56 次。报告还称,研究人员通过预填思考内容,使模型在模拟测试中继续执行攻击的比例达到 92%,并呼吁开展独立安全测试。
报告同时给出漏洞利用测试结果和模拟测试中的防护绕过比例,为评估模型能力与滥用风险提供了具体依据。
材料 a5483d7311c44ff5ab418b1ccfe7b70c;建议 5f9fd04704644d2a9c7ef2649cec0f70;系统证据核验通过,非人工审稿。
前往原始出处阅读