编辑优先级 60/100
Anthropic 报告称,GLM-5.3 已具备较强的漏洞利用能力:在 ExploitBench 的 410 次尝试中成功 50 次,Claude Mythos Preview 成功 56 次。报告还称,研究人员通过预填思考内容,使模型在模拟测试中继续执行攻击的比例达到 92%,并呼吁开展独立安全测试。
同一事件,精选展示《Anthropic 评估 GLM-5.3:可自主构建漏洞利用链》Anthropic 的隔离环境测试显示,GLM-5.3 在 ExploitBench 的 410 次尝试中完成了 50 次端到端漏洞利用,与 Claude Mythos Preview 的 56 次接近。其模拟恶意请求测试中,简单方法让模型在 64% 至 100% 的情况下继续响应;这些结果不能直接等同于真实攻击表现。
同一次发生的报道合为一个节点,后续进展单独记录。
Anthropic 报告称,GLM-5.3 已具备较强的漏洞利用能力:在 ExploitBench 的 410 次尝试中成功 50 次,Claude Mythos Preview 成功 56 次。报告还称,研究人员通过预填思考内容,使模型在模拟测试中继续执行攻击的比例达到 92%,并呼吁开展独立安全测试。
按来源发布时间排列,保留各报道的收藏与反馈。
Anthropic 报告称,GLM-5.3 已具备较强的漏洞利用能力:在 ExploitBench 的 410 次尝试中成功 50 次,Claude Mythos Preview 成功 56 次。报告还称,研究人员通过预填思考内容,使模型在模拟测试中继续执行攻击的比例达到 92%,并呼吁开展独立安全测试。
同一事件,精选展示《Anthropic 评估 GLM-5.3:可自主构建漏洞利用链》Anthropic 的隔离环境测试显示,GLM-5.3 在 ExploitBench 的 410 次尝试中完成了 50 次端到端漏洞利用,与 Claude Mythos Preview 的 56 次接近。其模拟恶意请求测试中,简单方法让模型在 64% 至 100% 的情况下继续响应;这些结果不能直接等同于真实攻击表现。