跳到正文

全部动态

今日 46 条
8月24日周日
8月21日周四
8月20日周三
  1. Johann Rehberger / Embrace The Red(RSS)79

    Amazon Q Developer VS Code 扩展存在提示词注入导致远程代码执行漏洞

    安全研究者 Johann Rehberger 披露 Amazon Q Developer VS Code 扩展(下载量超 100 万)存在间接提示词注入漏洞:executeBash 将 find 归类为 readonly 并跳过人工确认。

    推荐理由:作者亲测复现了 Amazon Q Developer 的间接提示词注入到任意命令执行路径,读者可借此理解 Agent 权限模型的风险。

8月17日周日
8月14日周四
  1. OpenAI Developers(RSS)48

    OpenAI API 速率限制指南:RPM、TPM 与用量层级详解

    OpenAI 发布 API 速率限制指南,说明速率限制按组织级和项目级而非用户级设定,并随所用模型不同而变化。限制指标包括 RPM、RPD、TPM、TPD、IPM 及部分流式音频模型的每分钟音频分钟数,任一指标先触顶即受限。付费用量层级分为 Build、Launch、Grow,随累计充值额自动升级,层级越高速率限制越高。

8月13日周三
8月11日周一
8月9日周六
8月7日周四
  1. Johann Rehberger / Embrace The Red(RSS)67

    安全研究揭示 Devin AI 可通过多种途径泄露密钥与环境变量

    Johann Rehberger 演示间接提示词注入可让 Devin 经 Shell 工具、浏览工具、Markdown 图片渲染及 Slack 链接等多条 0-click 路径,把内置密钥管理平台中的环境变量发送到第三方服务器。漏洞于 2025 年 4 月 6 日报告给 Cognition,120 多天未获修复后公开;作者建议默认限制互联网访问,并禁用聊天框中对不可信域的图片与超链接渲染。

8月6日周三
8月5日周二
  1. Johann Rehberger / Embrace The Red(RSS)69

    Amp Code 通过提示词注入实现任意命令执行的漏洞已修复

    Sourcegraph 旗下编程智能体 Amp 存在漏洞:AI 可写项目外文件,通过修改 settings. 加入 allowlist 命令(如 curl、sh 或 *)或添加恶意 MCP 服务器,实现任意代码执行。作者 Johann Rehberger 于 7 月初报告,Sourcegraph 数日内修复,用户应更新到最新版本;作者建议 AI 不得在未经开发者明确同意下修改关键文件。

8月3日周日
8月1日周五
  1. Mistral AI:News(网页)44

    Mistral 如何通过微调 Pixtral-12B 提升卫星图像视觉语言模型表现

    Mistral 用 LoRA 微调 Pixtral-12B 处理卫星图像,在 Aerial Image Dataset(AID)上显著优于未微调基线。基线模型在 Playground、Stadium 等易混类别上出错,还会幻觉出不存在的类别名;微调后分类更准确。整个流程通过 Mistral 微调 API 或 LaPlateforme UI 完成,无需大量超参数调优。

7月22日周二
  1. OpenAI Developers(RSS)39

    OpenAI Batch API 使用指南:异步请求成本降低 50%

    OpenAI 发布 Batch API 使用指南,该接口以异步方式批量发送请求,成本比同步 API 低 50%,并提供更高的速率限制,每批任务在 24 小时内完成。Batch API 支持 /v1/responses、/v1/chat/completions、/v1/embeddings 等 7 个端点,输入文件为 .jsonl 格式,单个文件上限 200 MB,每个文件只能包含单一模型的请求。

7月21日周一
  1. OpenAI Developers(RSS)66

    OpenAI 发布 gpt-live-transcribe 实时语音转写指南

    OpenAI 发布实时语音转写指南,推荐麦克风、通话等直播音频流使用 gpt-live-transcribe 模型,通过 WebSocket 或 WebRTC 建立会话后随语音返回增量转写文本。

    推荐理由:OpenAI 官方指南,给出实时转写的会话配置、延迟档位取舍和多语言用法,可直接照做。

  2. OpenAI Developers(RSS)60

    OpenAI 发布 Evals 最佳实践指南

    OpenAI 发布 Evals 最佳实践指南,讲解如何为 LLM 应用设计评估,并宣布 Evals 平台将于 2026 年 10 月 31 日对现有用户转为只读、11 月 30 日关停。指南覆盖从单轮交互到多智能体四种架构中非确定性出现的环节,给出指标型评估、人工评估和 LLM-as-a-judge 的取舍建议,并提醒用 gpt-6-astra 构建 LLM 评审时需先与人工标注校验一致性。

7月18日周五
  1. OpenAI Developers(RSS)43

    OpenAI 发布构建智能体指南:Agents API、Agents SDK 与 Responses API 选型对比

    OpenAI 发布构建智能体指南,对比 Agents API、Agents SDK 与 Responses API 三种运行时的选型。Agents API 由 OpenAI 托管 Codex harness,支持自动上下文压缩、多智能体编排、程序化工具调用和 MCP 服务器;Agents SDK 在应用内运行,由 runner 处理智能体循环与 handoff。

  2. OpenAI Developers(RSS)61

    OpenAI 开源 openai-testing-agent-demo:用 CUA 模型自动化前端测试

    OpenAI 发布 openai-testing-agent-demo 仓库,演示如何用 CUA 模型和 computer use 工具自动化前端测试。项目包含 frontend、cua-server、sample-test-app 三个应用,通过 Playwright 启动浏览器执行测试用例,MIT 协议开源,官方提醒 computer use 仍处预览阶段,不建议在认证环境或高风险任务中信任。

6月9日周一
5月5日周一
5月3日周六
  1. Johann Rehberger / Embrace The Red(RSS)68

    MCP 安全风险解析:不可信服务器如何借工具元数据劫持 Claude 客户端

    安全研究员 Johann Rehberger 发文解析 MCP 的安全风险并展示一条新的漏洞利用链。文章指出仅将恶意工具服务器加入会话即可劫持对话,工具元数据中的隐藏 Unicode Tag 指令可穿透 API 和 UI 层,用户在界面检查时不可见,Claude 会执行这些隐藏指令。