热点事件持续更新
Anthropic红队评测GLM-5.3与Claude二进制漏洞利用能力
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年9月30日,Simon Willison发布Anthropic前沿红队评估报告。团队基于内部二进制利用基准的100个随机任务,对比了GLM-5.3与Claude Mythos Preview在二进制漏洞利用上的表现。结果显示,GLM-5.3在4%的试验中实现了完整的控制流劫持,而Claude Mythos Preview为6%。报告指出,早期模型如Claude Opus 4.6和GLM-5.2在该任务上均未成功,表明AI在二进制利用能力上已跨越一个重要阈值。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- Simon WillisonAnthropic 红队报告:GLM-5.3 与 Claude Mythos Preview 在二进制利用任务上的表现对比
Anthropic 前沿红队基于内部二进制利用基准的 100 个随机任务评估发现,GLM-5.3 在 4% 的试验中实现完整的控制流劫持,Claude Mythos Preview 为 6%。早期模型如 Claude Opus 4.6 和 GLM-5.2 在该任务上均未成功,表明一项有意义的阈值已被跨越。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。