Augment 如何用 Cosmos 智能体团队消除代码审查瓶颈
Augment 在 Cosmos 上重建代码审查流程,由 PR Risk Analyzer、Bug Reviewer、Pair Reviewer 等 Expert 组成智能体团队,自动批准低风险改动、逐行做正确性分析,仅在需要判断时引入人类。
Augment 在 Cosmos 上重建代码审查流程,由 PR Risk Analyzer、Bug Reviewer、Pair Reviewer 等 Expert 组成智能体团队,自动批准低风险改动、逐行做正确性分析,仅在需要判断时引入人类。
Augment 在 Terminal Bench 2.0 上用 Opus 4.7 对比 Auggie CLI 与 Claude Code,Auggie 通过率 67.4% 对 66.3%,总 token 少 32%、成本低 33%($463.04 对 $694.50)。
Augment Code 的 Cosmos 平台让智能体串联代码审查与事故响应等环节,大型 PR 的人工审查时间从六七小时降到 45 分钟,周产出提升至三倍。事故响应中智能体已处理 81.3% 的告警,值班工程师每周合并的 PR 增加 44%,首次 RCA 时间从约 30 分钟降至 6 分钟。人类仍负责设计判断、风险把控与最终决策。
Augment Code 推出 Project Builder,这是一个运行在 Cosmos 上的专家,可从简短功能描述生成基于真实代码库的设计文档(markdown 或 HTML 存入 Cosmos VFS),经人工评审后编排 worker agent 完成实施直至合并。
Augment Code 构建了名为 Mimi 的 AI 数据分析师,接入 Linear、Slack 和 GitHub,并从 Hex 认证报告与 dbt 模型(Mimir 仓库)取数回答团队提问。
ARC Prize 官方推出 ARC-AGI-Pub 公开排行榜,使用公开评测集,取消算力限制、允许联网,并提供 15 万美元验证基金,对复现并验证的高分提交报销最高 $2,500 API 费用。
ARC Prize 上线 Daily Puzzle,每天 UTC 12 点从 ARC-AGI 任务中选出一道作为当日谜题,Play 页面成为其主页,点击 Start 后开始计时并统计尝试次数。该功能无奖金,结果可分享至 X/Twitter、Discord 等平台,官方称这是 v1,后续将根据反馈加入教程等功能。
Black Forest Labs 发布 FLUX VTO 虚拟试穿模型,现已公开可用,并加入 FLUX MCP。单次生成低于 4 秒,可自托管实现亚秒级响应,最多可给同一模特叠加 4 件服装,并保留人物身份与服装的 logo、印花、缝线和配件细节。默认审核政策下不支持泳装和内衣,官方提示精确的身材与服装尺码功能仍在演进,输出适合作为视觉搭配参考。
Black Forest Labs 宣布 FLUX.2 [klein] 4B 将预装在 ASUS 下一代 ProArt RTX 笔记本的 MuseTree 应用中,该产品线在台北 Computex 2026 上亮相。
Anthropic 为 Claude 推出插件市场,收录 340 个插件,可将工具、技能与集成打包为一键安装。
推荐理由:原文列出了插件市场的实际内容和安装方式,读者可以据此挑选适合自己的 Claude 扩展组合。
Anthropic 为 Claude 上线 Connectors 连接器目录,共收录 872 个连接器,把用户已有的工具接入每一段 Claude 对话。目录中包含 Microsoft 的 Playwright MCP server,可让 Claude 操作网页、截图、填表和自动化测试,以及 Upstash 的 Context7 MCP server,用于拉取版本相关的文档与代码示例。
Anthropic 博客汇总了近期 Claude 产品更新:Claude Cowork 与聊天已合并为统一的 Claude,Claude in Chrome 正式可用,Claude Code 支持 artifacts,Claude Marketplace 上线以集中发现合作伙伴的插件、智能体与服务。
Anthropic 上线 Claude 平台控制台登录页,供开发者基于前沿 Claude 模型和托管智能体基础设施构建智能体与应用。页面提示继续操作即表示同意 Anthropic 商业条款、使用政策并确认隐私政策,面向使用 Claude API 的公司。
Claude 现已在 Microsoft Foundry 正式可用,企业可用现有 Azure 认证、计费与治理体系构建生产应用和企业智能体,用量计入 Azure 账单,符合条件的支出可计入 MACC。
推荐理由:原文说明 Claude 在 Microsoft Foundry 正式可用后的计费、合规与部署方式,读者可据此评估接入 Azure 工作流的可行性。
Anthropic 推出 Claude on AWS,让团队在 AWS 环境中使用 Claude 构建智能体并向客户交付 AI 产品。该方案提供 Claude API 与原生 Claude 体验,支持 AWS 原生认证、IAM 与审计集成,并通过 AWS 统一账单计费、计入 AWS 承诺消费。
Anthropic 为 Claude 推出区域数据驻留与推理驻留能力,用户可指定提示词、输出和对话历史的存储地及模型处理地,覆盖亚太、加拿大、欧洲和美国(美国即将上线),可通过 AWS Bedrock、GCP Vertex 和 Microsoft Foundry 部署。
Anthropic 上线 Claude Marketplace,汇集 15 款 Claude 驱动的合作伙伴产品,包括 Cursor、GitLab、Snowflake、Vercel、CodeRabbit、Lovable 等。企业可将现有 Anthropic 采购承诺用于这些工具,统一 AI 支出,并随需求增加合作伙伴。
Anthropic 推出 Claude Marketplace 生态系统,提供超过 2000 个连接器和插件,可连接 Google Drive、Gmail、Microsoft 365、Notion、Slack、Atlassian 等应用。
推荐理由:Anthropic 官方页面列出了生态的实际组成和开放入口,读者可以据此了解 Claude 周边的连接器、产品和合作资源。
Anthropic Claude Platform 页面列出 Claude Fable 5.1、Opus 5.5、Sonnet 5.5 和 Haiku 4.5 的定价与适用场景,如 Opus 5.5 定价 Input $4 / MTok、Output $20 / MTok,面向智能体编码和企业工作。
推荐理由:原文给出各型号模型定价、上下文与用量场景,读者可据此对照选择构建智能体的方案。
Anthropic 推出面向小型企业的 Claude for Small Business 插件,提供可定时运行的工作流:周一简报、月度结账、跟进线索并生成报价。
推荐理由:原文给出具体工作流、审批机制和数据安全细节,读者可判断这套面向十人以下企业的自动化方案是否适合自己。
Anthropic 发布 Claude 的 Sales 销售插件,并宣布 Salesforce in Claude(beta),内置 37 项预置技能,覆盖续约准备到会后跟进,所有操作回落到 Salesforce 并按销售原有权限执行。
Anthropic 为公益机构推出 Claude 非营利专项方案,提供适配非营利预算的 Team 与 Enterprise 套餐,含协作工作区、高级权限和企业级安全,并可直接对接 Blackbaud、Benevity、Candid 等平台。
Anthropic 宣布通过面向科学家的 Claude team plan 开放 10,000 个席位,全球科学家可免费或以折扣价使用 Claude 订阅一年,标准席位免费,5 倍用量上限的高级席位每月 15 美元。
Anthropic 发布 Claude Science 公开测试版,可伴随研究团队从首个假设到最终投稿全程工作,提供完整引用与审计追踪。该产品基于 Claude 的智能体能力,用于减少拼接流程的时间,让研究人员专注科学本身。BMS、Genentech、AstraZeneca、AbbVie 等药企已在使用 Claude 推进研发与临床试验相关工作。
Anthropic 开启 Model Hardware Standard(MHS)研究预览,向首批科研实验室和先进制造商开放这一让 AI 智能体安全操作物理设备的共享规范。
Anthropic 展示了 Claude 在法律场景的能力:接入 iManage、NetDocuments、Docusign、Ironclad 和 Thomson Reuters,输出可溯源,并推出面向商事、公司、IP、诉讼等领域的插件。
Anthropic 面向 K-12 教师发布了一份 8 年级光合作用形成性评估表,对应 NGSS MS-LS1-6 标准,不计分。评估分 Part A 核心概念与 Part B 证据推理两部分,共 10 题,并附答案要点与教师提示,重点针对“植物质量来自土壤”“碳原子来自阳光”等常见误解。
Anthropic 发布面向高校的 Claude 高等教育方案,帮助大学推进科研、支持教学并提升运营与学生支持系统效率。方案包含学习模式、Claude for Word、Claude Code、Claude Cowork、Claude for Research Labs 与 Claude Science 等工具,覆盖学生、教师和行政人员。
Anthropic 展示 Claude 在医疗领域的应用,覆盖预授权审核、理赔申诉、患者消息分诊和临床文书生成。预授权示例中 Claude 完成 NPI、CPT、ICD-10 与 LCD L38319 覆盖政策校验并给出 APPROVE 建议,临床文书示例称从 12 分钟录音生成文档耗时 47 秒。
Anthropic 推出面向政府机构的 Claude for Government,可在 AWS 和 Google Cloud 上以最高 FedRAMP High 和 IL5 授权通过既有采购渠道获取。
Anthropic 推出面向企业的 Claude Enterprise,提供 SSO/SAML、SCIM、审计日志、合规 API 及 HIPAA-ready 等管理控制,数据默认不用于训练模型。企业可将 Claude 部署到 Chat、Claude Cowork、Claude Code 及自有产品中,官方称复杂代码迁移可减少 90% 耗时。
Anthropic 展示用 Claude 打造客户支持智能体:依托内部知识跨系统与工具执行操作,支持智能对话路由、多语言多渠道个性化回复,以缩短解决时长并降低支持成本。
Anthropic 推出面向零售、旅游、电信和娱乐行业的 Claude Commerce agents,提供可 fork 的开源蓝图仓库,包含两类智能体、四个垂直行业参考实现和一个 Claude Code 插件。
Anthropic 公布 Claude 在编程场景的能力数据:Opus 5.5 在 Terminal-Bench 4.0 上得分 66.4%,为某 AI 平台客户带来 60 倍更快的代码审查反馈,为某企业软件客户将测试运行时间缩短 95%。
Claude Code 面向企业遗留代码库的现代化改造,结合 AI 代码生成与深度代码库理解,在保持业务逻辑完整的前提下支持可扩展迁移。它能生成依赖图、识别死代码、按复杂度与业务影响排定重构优先级,并自动为重构代码创建单元测试、补充回归测试。该工具可接入现有 CI/CD 流水线与版本控制系统,满足企业级安全与合规要求。
Anthropic 发布工程长文,介绍用 Claude 构建能规划、行动与协作的 AI 智能体,并称 Claude 在客户支持到编程等智能体场景中表现优于其他模型。
Anthropic 公布 Claude 订阅方案:Free 档 $0,Pro 档年付 $17/月($200 一次性付清)、月付 $20,Max 档 $100/月起,可选 Pro 5 倍或 20 倍用量。
Anthropic 上线 Claude 应用的统一下载页,提供 macOS、Windows、Linux(beta)桌面端和 iOS、Android 移动端。桌面应用内可直接运行 Claude Code,支持远程控制、跨设备记忆同步、Chrome 等扩展连接本地工具,并面向企业提供 MSIX/PKG 安装包和 SSO 部署;Linux 端暂不支持 Computer Use 和听写功能。
推荐理由:页面汇总了 Claude 桌面与移动应用的下载入口、各平台支持情况和常见使用限制,方便读者判断适配自己的版本。
Anthropic 推出 Agent Skills,用带 SKILL.md 的文件夹把流程和最佳实践变成 Claude 可自动调用的能力。同一 Skill 可跨 Claude.ai、Claude Code 和 API 使用,支持多 Skill 组合,内置 Excel、PowerPoint、数据分析等常用技能,Box、Notion、Figma、Canva 等伙伴展示了各自的应用方式。
推荐理由:Anthropic 官方页面说明 Skills 的构建方式、跨平台复用和内置能力,读者可以据此判断是否将其纳入自己的工作流。
Anthropic 推出 Claude for Microsoft 365,Claude 可直接在 Excel、PowerPoint、Word 和 Outlook 中工作。
推荐理由:原文来自官方,给出了四大 Office 应用中的具体能力和可用性细节,读者可据此评估是否替换现有办公工作流。