跳到正文
开源中国·· 4 天前精选AI 评分78

Anthropic 红队评估 GLM-5.3:自主漏洞利用能力追平 Claude Mythos Preview

Anthropic 红队盯上 GLM-5.3:能力追平 Mythos,却连拒绝护栏都是摆设

AI 导读

Anthropic 前沿红色团队评估智谱 GLM-5.3,认为它是首个能像五个月前 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎未设拒绝护栏就放出的模型。五个月前 Anthropic 发布 Claude Mythos Preview 时,曾称其为第一个能自主构建复杂端到端漏洞利用的 AI 模型。

推荐理由

Anthropic 红队对 GLM-5.3 的评估给出了自主漏洞利用能力与拒绝护栏缺失的对比,可了解前沿模型安全评估的一种视角。

来源:开源中国 · oschina.net