跳到正文
热点事件持续更新

Anthropic红队评测GLM-5.3与Claude二进制漏洞利用能力

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年9月30日,Simon Willison发布Anthropic前沿红队评估报告。团队基于内部二进制利用基准的100个随机任务,对比了GLM-5.3与Claude Mythos Preview在二进制漏洞利用上的表现。结果显示,GLM-5.3在4%的试验中实现了完整的控制流劫持,而Claude Mythos Preview为6%。报告指出,早期模型如Claude Opus 4.6和GLM-5.2在该任务上均未成功,表明AI在二进制利用能力上已跨越一个重要阈值。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. Simon Willison
    Anthropic 红队报告:GLM-5.3 与 Claude Mythos Preview 在二进制利用任务上的表现对比

    Anthropic 前沿红队基于内部二进制利用基准的 100 个随机任务评估发现,GLM-5.3 在 4% 的试验中实现完整的控制流劫持,Claude Mythos Preview 为 6%。早期模型如 Claude Opus 4.6 和 GLM-5.2 在该任务上均未成功,表明一项有意义的阈值已被跨越。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。