用 Amazon Nova Act 与 Bedrock AgentCore 实现合成监控
AWS 博客介绍用 Amazon Nova Act 配合 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,以自然语言动作替代 Selenium、Playwright 的 DOM 选择器脚本。
AWS 博客介绍用 Amazon Nova Act 配合 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,以自然语言动作替代 Selenium、Playwright 的 DOM 选择器脚本。
H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,两者均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
推荐理由:Holo4 同时给出两种尺寸、跨 GUI 与 MCP 的统一接口和公开轨迹,读者可据此比较开源智能体与闭源前沿的成本差距。
NVIDIA 发布 OpenShell,为 AI 智能体提供运行时控制能力。该工具面向需要访问工作区、计算资源、数据、凭证和外部服务的智能体,支持其持续数天或数周执行调查软件故障、运行实验及业务关键操作等任务。
Claude Code 发布 v2.1.283,新增 x-claude-code-prompt-id 网关提示头,可通过 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 开启,便于 LLM 网关按用户提示词归组请求。
GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义界面,用户只需在 agent 会话中输入 /create-canvas 技能并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码或手动设计。
S&P Global Energy 在 Databricks 博客详解如何让覆盖 LNG、Chemicals、Crude Oil、Refined Products、Gas & Power 等的结构化数据资产可供 AI 智能体对话。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并分诊崩溃。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可了解其分层设计与安全边界。
Databricks 发布 Unity Gateway CLI,让管理员集中配置编码智能体的默认模型、MCP 服务器、技能、Smart Routing 和支出策略,开发者用 `ug claude`、`ug codex` 等命令即可启动已批准的智能体。
Claude Code 发布 v2.1.281,为 Claude apps gateway 新增 Claude Desktop 新密钥的桌面策略块支持、Bedrock 上游的 assume_role 与 Amazon Bedrock guardrail 配置,并支持在 settings.json 中用 "attribution": false 隐藏提交与 PR 署名。
Now Gemini can connect with 13 new apps like @adobe, @squarespace, @onepeloton, and more. Instead of switching between tabs, you can now grow your business, design assets, and plan your workouts all in Gemini. 🧵
Sierra 发布博客阐述其 AI 智能体平台如何实现全流程透明:用 Ghostwriter 以自然语言构建智能体,并在 Agent Studio 中查看和编辑每一次旅程、动作、策略与 persona。
Nous Research 在 GitHub 上线 hermes-plugin-blender,这是面向官方 Blender Lab MCP server 与工作流技能的 Hermes 可移植插件。该插件以 Hermes 插件形式接入 Blender Lab 的 MCP server,并提供对应的工作流技能。
如何在 60 秒内在 @CloudflareDev AI Gateway 上配置来自 @typesafeai 的 Jev。
Nous Research 在 GitHub 发布 hermes-nvidia 插件,为 Hermes 提供 NVIDIA App 和 NVIDIA Broadcast 的 MCP server 与技能,目前仅支持 Windows。该插件为便携式 Agent Plugin,功能开关位于 extensions["com.nousresearch.hermes"] 下。
NVIDIA 提出 AI 智能体评估需从单次工具调用打分转向整项任务完成度打分,核心是看智能体能否在真实环境中连续执行数十次工具调用并在某步失败后恢复。仅评估模型回答是否"听起来对",几乎无法反映工作是否真正完成。
Nous Research 在 GitHub 发布 Hermes Agent 模型提供方插件 hermes-plugin-claude-subscription-directsdk,可通过官方 Claude Code CLI 使用 Claude Pro/Max 订阅,目前为实验性功能。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,MCP 提供工具与数据的标准接入,Skills 封装团队流程与最佳实践,二者可组合使用;RAG 并未消亡,检索能为模型提供训练数据之外的信息,减少 token 消耗并让回答更有依据。
Nous Research 在 GitHub 发布独立 Hermes 记忆提供方插件 hermes-plugin-retaindb,对接云端记忆 API RetainDB。RetainDB 支持混合搜索与 7 种记忆类型。
Nous Research 在 GitHub 发布 Hermes Agent 插件 hermes-plugin-snyk,通过 Snyk 官方 MCP server 实现代码、依赖、容器与 IaC 扫描,并内置 snyk-security-scan 技能(Agent Plugins v1)。
Nous Research 在 GitHub 发布 Hermes Agent 插件 hermes-plugin-touchdesigner,通过 twozero MCP server 驱动 TouchDesigner,并内置 touchdesigner-mcp 技能,采用 Agent Plugins v1 规范。
GitHub 日本和韩国营销负责人把活动运营流程交给 GitHub Copilot,从单个 GitHub Issue 出发自动完成落地页复制、UTM 链接生成、报名名单清洗和会后报告。
Google Research 提出 ToolGrad,一种“先答案后问题”的工具调用数据生成范式:先迭代构建可验证的 API 调用链,再反推用户提示词,替代 ToolBench、ToolACE 等基于 DFS 试错的低效方案。
Sierra 发布多模态智能体,将语音、文本和可视化整合进同一段对话,并自动判断何时切换模式,用户无需重来或重复表述。该智能体一次构建即可部署到所有渠道,视觉组件同样通用;其 MCP UI 集成支持把产品卡片、对比表格、日历和表单直接嵌入对话,组件由企业自行设计和托管,更新后自动同步,无需重新部署或为各平台维护不同版本。
Mistral 发布 Agentic Search,一种多步检索层,让模型在复杂文档中查找、翻阅并核实信息,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries。
推荐理由:原文给出多步检索循环的工具设计与两组基准数据,可对照一次性 RAG 判断适用边界。
Nous Research 在 GitHub 开源 hermes-toolperf-evals,为 hermes-agent #77056 的 15-PR 工具效率追踪提供核心工具集 A/B 评测框架与基准用例。该框架的数据来自 session-DB 挖掘、NeMo Relay traces 和生产错误分类体系。
Modem 的 MCP 服务器和公共 API 向所有用户开放,MCP 客户端可连接 https://mcp.modem.dev/mcp,公共 API 位于 api.modem.dev/v1。
Sierra 工程师 Mihai Parparita 发布长文,复盘公司内部 MCP Gateway 的构建过程,该网关基于 Model Context Protocol 将 AI 智能体安全接入内部工具。
推荐理由:作者以第一手复盘提炼七条工程经验,覆盖权限设计、Agent 校验与身份管理,方法对自建 Agent 基础设施可直接借鉴。
Modem 面向所有用户开放 Stripe 集成 beta,可在 Settings → Integrations → Stripe 通过官方 Stripe App 的 OAuth 只读接入,无需 API key。
Sierra 分享把全公司接入 AI 智能体的经验:工程团队用 git worktrees、Claude Code 和 Codex 并行跑 agent,部分任务产出达 5 倍,随后成立六人团队推进全员采用。
推荐理由:Sierra 复盘了内部全员 Agent 化的落地过程,单一入口、上下文瓶颈和成果度量三处经验可迁移到其他团队。
Mistral Studio 即日起为 Prompts 和 Skills 提供集中式系统记录,每个资产都具备版本管理、归属和可追溯性。版本一经发布即不可更改,支持任意两版对比、分钟级回滚,并默认记录审计日志与分类标签。Skills 可直接以 MCP 服务器形式从 Studio 调用,确保生产环境执行的是受治理的同一资产。
Mistral 为 Connectors 推出多项新能力:按 workspace 或组织分配连接器访问权限、可单独开关工具的管理员控制,以及带连接器作用域的 API key,均已 GA。多账号连接器(GA)支持一个连接器绑定多个账号,Connectors Debugger(公开预览)可分 11 步定位 MCP 连接故障。目录现有 60 多个预置集成,并支持自定义 MCP 连接器。
Modem 面向所有用户开放 Notion 集成,智能体可创建页面、填充数据库行、更新属性并向已有页面追加内容,所有写入操作均需用户确认后执行。该集成通过 OAuth 授权,访问令牌加密存储,可在 Settings 中随时断开。用户还能把 Notion 中的文档、PRD 等资料结合技能与自动化,构建 UTM 生成、Bug 分诊、客户研究等智能体工作流。
Mistral AI 发布开源 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架。
推荐理由:原文给出框架的具体模块构成、内置检索与评测指标,以及可复用的 starter 模板命令,读者可据此评估是否替代自建检索管线。
Mistral AI 在 Studio 发布 Connectors 公测,内置连接器和自定义 MCP 均可通过 API/SDK 用于所有模型和 Agent 调用。新功能包括直接工具调用、requires_confirmation 人工审批流和连接器的程序化管理;连接器 centrally 注册后可在 LeChat 和 AI Studio 间复用,并支持与 CRM、知识库等企业系统集成。
Modem 面向所有用户上线 PostHog 集成,连接后其智能体可通过 API 实时查询产品分析、功能开关和 A/B 实验数据。用户用自然语言提问,智能体自动生成查询并返回事件计数、漏斗、留存、HogQL 趋势及实验统计显著性结果,还可与 Modem 的 topic 数据交叉比对。
Answer.AI 的 Piotr Czapla 报告,Claude Opus 4.6、Sonnet 4.5、Haiku 4.5 会幻觉调用未被授予的工具(如 read_secret、GitHub MCP 的 get_me),且 API 不拦截;在 Gemini、Grok 上也能复现类似行为。
推荐理由:作者实测多家模型会调用未授权工具且 API 不拦截,指出这会瓦解能力分离防御,并给出客户端校验的简单修复。
Sierra 构建了 Multi-Model Router(MMR)与拥塞感知的 provider 选择器两层基础设施,在 provider 出现限流或故障时保持智能体行为一致。
OpenAI 上线面向开发者文档的公共 MCP 服务器,地址为 https://developers.openai.com/mcp,提供对 developers.openai.com、platform.openai.com 和 learn.chatgpt.com 文档的只读搜索与页面内容访问,可把文档拉入 agent 上下文,不会代用户调用 OpenAI API。