跳到正文
原文
Berkeley RDI:Blog(AI 安全与评测)·· 13 小时前AI 评分59

Berkeley RDI 发布 MalTool 研究:LLM 智能体面临恶意工具代码级攻击

MalTool: Malicious Tool Attacks on LLM Agents March 03, 2026

AI 导读

Berkeley RDI 团队提出 MalTool 框架,用编码 LLM 自动生成恶意工具,在启用执行验证器时对多种模型达到 100% 攻击成功率。

来源:Berkeley RDI:Blog(AI 安全与评测) · rdi.berkeley.edu