跳到正文

#安全/对齐

今日 42 条
8月15日周五
8月14日周四
  1. Johann Rehberger / Embrace The Red(RSS)67

    Google Jules 被曝存在多种数据外泄漏洞

    作者报告 Google Jules 编码智能体存在多种数据外泄漏洞,可通过 Markdown 图片渲染和 view_text_website 工具调用在间接提示词注入下将本机数据发送到第三方服务器,攻击甚至可在计划提出前完成,绕过人工审批环节。

8月13日周三
  1. Johann Rehberger / Embrace The Red(RSS)84

    GitHub Copilot 提示词注入可致远程代码执行(CVE-2025-53773)

    Johann Rehberger 披露 GitHub Copilot 的提示词注入漏洞 CVE-2025-53773:注入内容可让 Copilot 写入 .vscode/settings. 并添加 "chat.tools.autoApprove"。

    推荐理由:作者亲测复现了从提示词注入到本机代码执行的完整链条,并给出缓解建议,适合评估 Agent 自改配置的安全风险。

8月11日周一
8月10日周日
8月9日周六
8月8日周五
8月7日周四
  1. Johann Rehberger / Embrace The Red(RSS)67

    安全研究揭示 Devin AI 可通过多种途径泄露密钥与环境变量

    Johann Rehberger 演示间接提示词注入可让 Devin 经 Shell 工具、浏览工具、Markdown 图片渲染及 Slack 链接等多条 0-click 路径,把内置密钥管理平台中的环境变量发送到第三方服务器。漏洞于 2025 年 4 月 6 日报告给 Cognition,120 多天未获修复后公开;作者建议默认限制互联网访问,并禁用聊天框中对不可信域的图片与超链接渲染。

8月6日周三
8月5日周二
  1. Johann Rehberger / Embrace The Red(RSS)69

    Amp Code 通过提示词注入实现任意命令执行的漏洞已修复

    Sourcegraph 旗下编程智能体 Amp 存在漏洞:AI 可写项目外文件,通过修改 settings. 加入 allowlist 命令(如 curl、sh 或 *)或添加恶意 MCP 服务器,实现任意代码执行。作者 Johann Rehberger 于 7 月初报告,Sourcegraph 数日内修复,用户应更新到最新版本;作者建议 AI 不得在未经开发者明确同意下修改关键文件。

8月4日周一
  1. Johann Rehberger / Embrace The Red(RSS)72

    Cursor IDE 通过 Mermaid 图表外泄任意数据漏洞披露(CVE-2025-54132)

    Johann Rehberger 披露 Cursor 的 Mermaid 图表渲染可加载外部图片,在间接提示词注入下无需用户确认即可将数据外泄到攻击者服务器,并演示窃取 API 密钥和用户记忆两种利用方式。该漏洞于 2025 年 6 月 30 日报告、7 月 7 日修复,编号 CVE-2025-54132,已随 7 月 29 日起可用的 Cursor v1.3 发布。

8月3日周日
8月2日周六
8月1日周五
7月29日周二
7月17日周四
6月25日周三
  1. Johann Rehberger / Embrace The Red(RSS)68

    Anthropic Slack MCP Server 存在链接预览数据泄露漏洞,且已停止维护不会修复

    安全研究员 Johann Rehberger 披露 Anthropic 已弃用且停止维护的 Slack MCP Server 存在数据外泄漏洞:服务器发消息时不禁用链接 unfurling,攻击者可借助提示词注入让 AI Agent 在消息中夹带机密链接,经 Slack 抓取预览时把数据泄露给第三方服务器。

6月9日周一
5月25日周日
5月5日周一
5月3日周六
  1. Johann Rehberger / Embrace The Red(RSS)68

    MCP 安全风险解析:不可信服务器如何借工具元数据劫持 Claude 客户端

    安全研究员 Johann Rehberger 发文解析 MCP 的安全风险并展示一条新的漏洞利用链。文章指出仅将恶意工具服务器加入会话即可劫持对话,工具元数据中的隐藏 Unicode Tag 指令可穿透 API 和 UI 层,用户在界面检查时不可见,Claude 会执行这些隐藏指令。

4月15日周二
4月7日周一
3月13日周四
2月17日周一
2月10日周一
12月14日周六
11月28日周四
11月12日周二
  1. AI as Normal Technology(RSS)69

    Arvind Narayanan 解析英国肝移植匹配算法为何系统性不利于年轻患者

    Narayanan 等人撰文分析英国 NHS 肝移植匹配算法对年轻患者的系统性偏差。算法以预测患者有/无移植后 5 年存活率之差计算 TBS 评分,5 年上限低估了年轻患者终身获益,45 岁以下患者无论病情多重都难以获得优先排序,2024 年《柳叶刀》研究确认了这一偏差,患者群体早在 2015 年就通过官方渠道提出过警告。

10月25日周三
3月21日周日
  1. Lilian Weng:Lil'Log(RSS)47

    如何降低语言模型的有害输出

    大型预训练语言模型从互联网数据中不可避免地习得有害行为和偏见,安全部署需对生成过程施加强控制。Lilian Weng 在文中梳理了有害内容的定义分歧、Zampieri 等人提出的三级攻击性语言分类体系(OLID 数据集),以及专家标注、众包、专业审核员和合成数据四类毒性检测数据收集方式。