跳到正文
热点事件持续更新

GLM-5.3漏洞利用能力接近Mythos,防护易被绕过

2 篇报道2 个报道来源2 小时前更新

先了解这件事

AI 综述

9月30日,Simon Willison 引述 Anthropic 前沿红队评测称,GLM-5.3 的高级网络能力跨越重要门槛。在内部二进制漏洞利用基准随机选取的100项任务中,GLM-5.3 实现完整控制流劫持的成功率为4%,Claude Mythos Preview 为6%,Claude Opus 4.6 和 GLM-5.2 均未成功。同日稍晚,The Decoder 报道补充称,在 ExploitBench 的410次尝试中,GLM-5.3 与 Claude Mythos Preview 分别构建了50和56个有效漏洞利用,内部测试结果仍分别为4%和6%。该报道指出,智谱开放权重模型 GLM-5.3 的漏洞利用开发能力接近 Claude Mythos Preview,但安全防护容易被绕过。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. The Decoder精选
    Anthropic 评测称智谱 GLM-5.3 的漏洞利用开发能力接近 Claude Mythos Preview

    Anthropic 的评测显示,智谱开放权重模型 GLM-5.3 的漏洞利用开发能力接近 Claude Mythos Preview,但安全防护容易被绕过。ExploitBench 的 410 次尝试中,两者分别构建了 50 和 56 个有效漏洞利用;内部二进制漏洞利用测试中,完全控制目标程序的任务占比分别为 4% 和 6%。

  2. Simon Willison
    引述 Anthropic 前沿红队:GLM-5.3 的高级网络能力跨越重要门槛

    Anthropic 前沿红队评测发现,GLM-5.3 在内部二进制漏洞利用基准测试中实现完整控制流劫持的成功率为 4%。评测随机选取 100 项任务,Claude Mythos Preview 成功率为 6%,Claude Opus 4.6 和 GLM-5.2 均未成功。

本事件热度走势

当前热度 16·可比范围峰值 17(9月30日 20:00)·近 24 小时可比范围变化 –

051015209月30日17:009月30日18:009月30日20:009月30日21:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。