跳到正文
原文
Berkeley RDI:Blog(AI 安全与评测)·· 16 小时前AI 评分64

UC Berkeley 发布 CyberGym-E2E:评测 AI 智能体端到端网络安全能力的大规模真实基准

CyberGym-E2E: Scalable Real-World Benchmark for AI Agents' End-to-End Cybersecurity Capabilities June 18, 2026

AI 导读

UC Berkeley 联合多校发布 CyberGym-E2E 基准,覆盖 139 个开源项目的 920 个真实漏洞,要求智能体完成从漏洞发现、PoC 构造到补丁生成的完整防御流程。

来源:Berkeley RDI:Blog(AI 安全与评测) · rdi.berkeley.edu