跳到正文

#MCP/工具调用

今日 2 条
今天10月1日周四
  1. Claude Code:GitHub Releases(RSS)40

    Claude Code v2.1.286 发布

    Claude Code 发布 v2.1.286,为堆叠的权限请求加上"2 of 5"计数,并支持在全屏列表中点击"N more"行跳转。该版本修复了 claude --resume 和 --continue 在并行工具调用后丢失全部轮次、工具或 hook 返回对象/数字/布尔值时触发 API 400 错误,以及云会话因容器在 transcript 加载中被停止而无法唤醒等问题。

9月30日周三
  1. xAI:News(网页)67

    xAI 发布终端编码智能体 Grok Build 早期测试版

    xAI 发布终端编码智能体 Grok Build 的早期测试版,面向所有 SuperGrok 和 X Premium Plus 订阅者开放。它支持计划模式审批、AGENTS.md、hooks、skills 和 MCP 服务器开箱即用,可将任务分派给并行运行的子代理,并提供 headless 模式(-p)与完整 ACP 支持。用户可输入 /feedback 提交反馈。

    推荐理由:官方介绍覆盖计划模式、并行子代理和 headless 模式等能力,读者可据此判断如何接入现有终端工作流。

  2. xAI:News(网页)54

    Grok 推出 Microsoft PowerPoint 加载项

    xAI 发布 Grok for PowerPoint,一款免费的 Microsoft 365 加载项,可从 Microsoft Marketplace 添加。用户可让 Grok 根据大纲生成完整幻灯片,包含 web 或 X 搜索的研究内容、图表和图片,也可单页添加、应用样式主题、重组章节,Grok 会主动提出澄清问题。

  3. xAI:News(网页)66

    xAI 发布 Voice Agent Builder 测试版:无需代码即可在 Grok Voice 上搭建生产级语音智能体

    xAI 宣布 Voice Agent Builder 进入测试版,这是一个运行在 Grok Voice 上的无代码平台,官方称约两分钟即可配置出可用的语音智能体。

    推荐理由:官方给出了完整功能、τ-voice Bench 排名和每分钟计费细节,读者可以据此评估它替代多 API 拼接语音方案的可行性。

  4. Fireworks AI(网页)50

    Fireworks AI:从租用闭源前沿模型到训练自有模型,企业迈向专业化智能的三阶段路径

    Fireworks AI 发文梳理企业迈向专业化智能的三阶段路径:先租用闭源前沿模型并围绕其搭建提示词、上下文与 harness 工程,再引入更便宜的开源模型优化成本与延迟,最终为真正属于自己的问题训练定制模型。文中以 Kimi K3 与 GPT 5.6 Sol 在 OSWorld 2.0、UIPad 上的对比为例,说明基准只能用于初筛,自建评测才是性能的最佳指标。

  5. Claude:Blog(网页)71

    Claude Marketplace 上线 340 个插件支持一键安装

    Claude 推出插件市场,收录 340 个插件,可一键安装为 Claude 添加工具、技能和集成。示例包括 GitHub 官方 MCP 服务器、Playwright 浏览器自动化、Figma 设计转代码、Supabase、Vercel 集成,以及代码审查、语言服务器和 CLAUDE.md 维护等开发类插件。

    推荐理由:页面列出了插件市场的主要品类和代表性插件,读者可以据此了解 Claude 现有可扩展能力的范围。

  6. Cohere Labs:官方研究博客42

    Cohere Labs 探讨 AI 将如何改变工作方式

    Cohere Labs 发布“Future(s) of Work”研究专题,探讨 AI 对工作方式的影响,并指出当前关于未来工作的讨论存在证据不足的问题。该专题推出 Agentic Task Ecosystem(ATE)数据集,基于 7 个目录中的 123,000 个公开 MCP 服务器,分析了 694,000+ 个可执行工具,将 AI 工具映射到真实职业任务。

  7. Anthropic:The Institute(旗舰研究长文 · 网页)23

    Anthropic 如何为 Claude 各产品构建隔离与管控机制

    Anthropic 分享了为 claude.ai、Claude Code 和 Cowork 构建隔离管控(containment)机制的工程经验,核心问题是如何在智能体能力增强、潜在影响范围扩大的同时限制其爆炸半径。相关文章还涉及 Claude Code 自动模式、长时运行智能体的 harness 设计,以及 Claude Opus 4.6 在 BrowseComp 中的评测意识等议题。

  8. Anthropic:The Institute(旗舰研究长文 · 网页)45

    Anthropic 为 Claude 推出 Connectors 连接器目录,收录 872 个连接器

    Anthropic 为 Claude 上线 Connectors 连接器目录,共收录 872 个连接器,把用户已有的工具接入每一段 Claude 对话。目录中包含 Microsoft 的 Playwright MCP server,可让 Claude 操作网页、截图、填表和自动化测试,以及 Upstash 的 Context7 MCP server,用于拉取版本相关的文档与代码示例。

  9. Anthropic:The Institute(旗舰研究长文 · 网页)32

    Claude 登陆 Google Cloud:用 Anthropic 模型构建高级 AI 智能体

    Anthropic 的 Claude 模型现可在 Google Cloud 上运行,支持 MCP、提示词缓存与专用容量,并可在无服务器基础设施上按负载扩展。该组合将 Anthropic 的安全模型与 Google Cloud 的基础设施、统一治理和安全控制结合,用于构建和部署生产级 AI 智能体。官方称有团队借此将代码开发速度提升 20% 至 30%。

  10. Anthropic:The Institute(旗舰研究长文 · 网页)65

    Anthropic 推出 Claude Marketplace 生态系统

    Anthropic 推出 Claude Marketplace 生态系统,提供超过 2000 个连接器和插件,可连接 Google Drive、Gmail、Microsoft 365、Notion、Slack、Atlassian 等应用。

    推荐理由:Anthropic 官方页面列出了生态的实际组成和开放入口,读者可以据此了解 Claude 周边的连接器、产品和合作资源。

  11. Anthropic:The Institute(旗舰研究长文 · 网页)79

    Anthropic 推出 Agent Skills,让 Claude 把机构知识封装为可复用能力

    Anthropic 推出 Agent Skills,用带 SKILL.md 的文件夹把流程和最佳实践变成 Claude 可自动调用的能力。同一 Skill 可跨 Claude.ai、Claude Code 和 API 使用,支持多 Skill 组合,内置 Excel、PowerPoint、数据分析等常用技能,Box、Notion、Figma、Canva 等伙伴展示了各自的应用方式。

    推荐理由:Anthropic 官方页面说明 Skills 的构建方式、跨平台复用和内置能力,读者可以据此判断是否将其纳入自己的工作流。

  12. Google Developers Blog(RSS)67

    Google 复盘 AI Agents Challenge 最强提交背后的 4 种工程模式

    Google 复盘其 AI Agents Challenge 获奖提交,归纳出四种反复出现的工程模式:双向 MCP(智能体既是自身工具的客户端也是可供其他智能体调用的 MCP 服务器)、基于事件总线的并行并发、回退模型必须通过与主模型相同的验证函数,以及在昂贵模型调用前做分层路由。

    推荐理由:Google 从获奖提交的真实代码里提炼四种智能体工程模式,双向 MCP、事件驱动并发、同标准回退和分层路由都给出可直接借鉴的做法。

  13. AWS Machine Learning Blog34

    Amazon Quick 提示词工程基础指南

    Amazon Quick 的提示词工程基础指南指出,提示词结构直接决定其 AI 功能输出的准确性与可靠性。文章给出清晰具体、提供业务上下文、用示例代替描述等核心原则,并介绍 CRISPE 框架,用于跨 Quick 各组件构建复杂提示词。这是两部分系列的第一篇,第二篇将覆盖 Research、Flows、Sight、Chat Agents 和 Action Integrations 的组件专属技巧。

9月29日周二