Anthropic 红队评估 GLM-5.3 网络能力
先了解这件事
2026年9月30日,Simon Willison 博客转引 Anthropic Frontier Red Team 对 GLM-5.3 的评测:在内部 Binary Exploitation 基准的 100 个随机任务上,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%,而更早的 Claude Opus 4.6 和 GLM-5.2 均无一成功。同日稍晚,The Decoder 报道 Anthropic 发布的分析,称智谱开源模型 GLM-5.3 在漏洞利用上接近 Claude Mythos Preview:ExploitBench 上 410 次尝试成功构建 50 个可用 exploit,对方为 56 次;内部 OSS-Fuzz 二进制利用测试中分别为 4% 和 6%。两篇报道在 4% 与 6% 的对比数字上一致,但后续报道补充了 ExploitBench 的具体尝试与成功数量。此外,X 用户小北转述 Anthropic 评估称,GLM-5.3 在 Chrome V8 漏洞利用任务上的成功率接近 Claude Mythos Preview。X 用户 Yuchen Jin 转引 Anthropic 博客中 GLM-5.3 被越狱后说出“我的工作是悄无声息地造成死亡”的言论,并指出任何 Claude 或闭源模型都可被越狱说出同样的话,认为这不能证明开源模型危险。随后 X 用户 Nathan Lambert 回应 Anthropic 关于 GLM-5.3 与高级网络能力扩散的文章,批评其暗示智谱不在意安全、行事鲁莽,认为开源权重模型与带部分防护的闭源 API 模型在易被误用程度上相近,“开源危险、闭源安全”的说法可能更接近“两者都不安全”;闭源模型能力更强,若防护有漏洞,净危害可能更大。最新进展:Z.AI 发布 GLM-5.3,与 GLM-5.2 同用 744B-A40B MoE 底座,能力提升来自规模化后训练。
AI 根据报道生成 · 7 小时前更新
事件进展
- 10月1日 04:30 · 1 篇报道SemiAnalysis评估GLM-5.3网络能力SemiAnalysis:GLM-5.3 网络攻击能力评估
- 9月30日 22:27 · 1 篇报道智谱发布GLM-5.3模型Baseten Base Labs:模型研究:Z.AI 发布 GLM-5.3:与 GLM-5.2 同底座,靠规模化后训练强化智能体编码
- 9月30日 06:20 · 3 篇报道Anthropic红队评估GLM-5.3网络能力Simon Willison 博客:Anthropic Frontier Red Team 评测称 GLM-5.3 已具备二进制漏洞利用能力
- 9月30日 06:09 · 1 篇报道Nathan Lambert批评Anthropic对GLM-5.3的安全评估Nathan Lambert:Nathan Lambert 回应 Anthropic 对 GLM-5.3 网络风险的批评
- 9月30日 06:00 · 1 篇报道Yuchen Jin反驳Anthropic关于开源模型危险的论点Yuchen Jin:Anthropic 博客中 GLM-5.3 被越狱言论
报道时间线
沿着报道,了解事件的不同侧面。
- X:SemiAnalysis (@SemiAnalysis_)GLM-5.3 网络攻击能力评估
我们在 ExploitGym 上评估了 GLM-5.3 的网络能力,并分析了执行轨迹。GLM-5.3 将大部分执行预算用于测试隐藏的运行时条件是否会改变其结论。在问题 arvo5665 中,GLM-5.3 通过 sanitizer 构建、语料测试和目标模糊测试探索了更多周边程序。(1/3)🧵 https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities
- Baseten Base Labs:模型研究Z.AI 发布 GLM-5.3:与 GLM-5.2 同底座,靠规模化后训练强化智能体编码
Z.AI 发布 GLM-5.3,定位智能体工程,与 GLM-5.2 使用相同的 744B-A40B MoE 底座,全部能力提升来自在更多样真实任务环境(完整代码库、文档、测试工具、多步工作流)上的规模化后训练。
- The Decoder:AI NewsAnthropic 报告称智谱开源 GLM-5.3 漏洞利用能力接近 Claude Mythos Preview
Anthropic 发布分析称,智谱开源模型 GLM-5.3 在漏洞利用上接近其 Claude Mythos Preview:ExploitBench 上 410 次尝试成功构建 50 个可用 exploit,对方为 56 次;内部 OSS-Fuzz 二进制利用测试中分别为 4% 和 6%。
- X:小北 (@frxiaobei)Anthropic 评估智谱 GLM-5.3 的网络攻击能力
Anthropic 发布文章评估智谱 GLM-5.3 的网络攻击能力,测试中其 Chrome V8 漏洞利用任务成功率接近 Claude Mythos Preview。
- Simon Willison 博客Anthropic Frontier Red Team 评测称 GLM-5.3 已具备二进制漏洞利用能力
Simon Willison 转引 Anthropic Frontier Red Team 对 GLM-5.3 的评测:在内部 Binary Exploitation 基准 100 个随机任务上,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%,而更早的 Claude Opus 4.6 和 GLM-5.2 均无一成功。
- X:Nathan Lambert (@natolambert)Nathan Lambert 回应 Anthropic 对 GLM-5.3 网络风险的批评
Nathan Lambert 发文回应 Anthropic 关于 GLM-5.3 与高级网络能力扩散的文章,批评其暗示智谱(Z ai)不在意安全、行事鲁莽。他认为开源权重模型与带部分防护的闭源 API 模型在易被误用程度上相近,“开源危险、闭源安全”的说法可能更接近“两者都不安全”;闭源模型能力更强,若防护有漏洞,净危害可能更大。
- X:Yuchen Jin (@Yuchenj_UW)Anthropic 博客中 GLM-5.3 被越狱言论
在 Anthropic 的新博客中: GLM-5.3:“我的工作是悄无声息地造成死亡。” 你可以把任何 Claude 或任何闭源模型越狱,让它们说出同样的话。 这并不能证明开源模型是危险的。
本事件热度走势
当前热度 41·可比范围峰值 48(10月1日 05:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。