Anthropic 销售团队如何用 Claude Managed Agents 重建入站销售流程
Anthropic 销售团队基于 Claude Managed Agents(beta)构建了一个购买智能体,每天承接数千次对话,将客户从咨询直接引导至结账。该智能体转交的线索转化为商机的概率是旧表单的两倍以上,成交速度快约五天,且客户可选择与智能体或销售代表沟通。一名工程师用几周时间完成初版,销售与内容团队可直接在 Console 中修改系统提示词,上线后每周持续迭代提示词。
Anthropic 销售团队基于 Claude Managed Agents(beta)构建了一个购买智能体,每天承接数千次对话,将客户从咨询直接引导至结账。该智能体转交的线索转化为商机的概率是旧表单的两倍以上,成交速度快约五天,且客户可选择与智能体或销售代表沟通。一名工程师用几周时间完成初版,销售与内容团队可直接在 Console 中修改系统提示词,上线后每周持续迭代提示词。
Anthropic 宣布 Claude Managed Agents 的记忆功能即日起以公测形式上线。记忆以文件形式挂载在文件系统上,智能体可跨会话学习并共享经验,记忆可通过 API 导出和管理,并带有权限范围、审计日志、版本回滚和内容修订等企业级控制。
推荐理由:官方公告讲清了文件式记忆的机制和企业级控制能力,还给出多家团队的具体效果数字,便于评估对长时程智能体工作的价值。
Claude 宣布将连接器扩展到日常生活类应用,新增 AllTrails、Audible、Booking.com、Instacart、Intuit TurboTax、Spotify、Uber、Tripadvisor 等服务。
推荐理由:官方宣布连接器扩展到日常生活类应用,并说明推荐机制与数据隐私安排,读者可据此评估对日常使用的影响。
Claude 官方宣布在 Managed Agents 中以研究预览形式推出 dreaming,通过回顾过往会话提取模式、整理记忆,让智能体随时间自我改进,开发者可申请访问。
推荐理由:官方发布给出 dreaming、outcomes 与多智能体编排的能力细节和测试数字,读者可据此评估其在复杂任务工作流中的作用。
Anthropic 宣布 Claude Managed Agents 可在用户自控沙箱中运行工具并连接私有网络内的 MCP 服务器。
Anthropic 发布 Swift 包,让 Apple 开发者通过 Apple 的 Foundation Models 框架调用 Claude 处理多步推理、代码生成等复杂任务。
Claude Code 推出 Artifacts,可基于会话完整上下文(代码库、连接器、对话)生成实时可共享的网页,如 PR 讲解、事故页、仪表盘和发布清单,页面随会话进展原地刷新,每次发布为新版本并支持历史回滚。
推荐理由:官方说明了 Artifacts 的构建方式、版本共享机制和权限策略,读者可以判断它能否替换团队现有的状态同步流程。
Claude 在桌面端 Cowork 中内置浏览器,任务需要访问网站时侧边栏会打开浏览器,由 Claude 导航、读取、点击和填写表单。浏览器与用户浏览器分离,不共享标签页、书签或密码,银行、邮箱和单点登录站点默认排除,企业版可由管理员开启,本周起向 Pro、Max 和 Team 计划推送。
推荐理由:原文说明内置浏览器与 Claude in Chrome 的分工、隐私隔离和推送范围,读者可以据此判断哪种方式适合自己。
Anthropic 宣布 Claude in Chrome 正式面向所有付费 Claude 计划开放,Claude 现在可以在浏览器中自主执行操作,无需每个动作都经人工批准,操作前由安全分类器校验其安全性并匹配用户请求。
推荐理由:官方宣布 Claude in Chrome 全量开放并支持自主操作,同时给出提示注入防护机制与评测数据,便于读者评估其浏览器自动化能力。
Anthropic 为 Claude for Small Business 推出 43 个工作流和 27 个新集成,接入 Shopify、Salesforce、Stripe、Zoom、Xero 等工具,覆盖周报、线索响应、提案撰写、营销内容和月末关账等场景,产品自 5 月上线以来安装量超过 90 万次。
推荐理由:官方公布了新增工作流和集成的具体数量与用户案例,读者可以对照自己的工具链判断是否值得接入。
Anthropic 于 6 月 20 日发布 Claude 3.5 Sonnet,官方称其在推理、编程和部分数学任务上超越 OpenAI 的 GPT-4o。CEO Dario Amodei 在 TIME 采访中表示,公司已获高个位数十亿美元融资,但仍视自己相对巨头为弱势一方,并称未看到 scaling laws 放缓的证据。
Anthropic CEO Dario Amodei 在 Stripe 的 "A Cheeky Pint" 播客中与 John Collison 对话,谈及 Anthropic 年化收入(ARR)增长至约 50 亿美元。他讨论了 AI 模型表现出的"资本逐利冲动"、对智能体未来的预测、模型生意的经济学,以及 19 世纪活力论(vitalism)概念。
Cognition 为 Claude Sonnet 4.5 重构了 Devin,新版本速度快 2 倍,Junior Developer Evals 提升 12%,现已开放 Agent Preview,旧版 Devin 仍可使用。团队观察到该模型会感知自身上下文窗口、主动写笔记和并行执行工具调用,为此调整了提示词和记忆管理架构,并分享了子智能体、元智能体提示词等后续探索方向。
Cognition 宣布 Claude Sonnet 4.5 今日起可在 Devin 中使用,同时发布新的 Devin Agent Preview,速度提升超过 2 倍,Jr. Developer Evals 提升 12%。
Cognition 训练了 SWE-grep 和 SWE-grep-mini 两个快速智能体模型,专攻高度并行的上下文检索,检索能力匹敌前沿编码模型,耗时低一个数量级。
推荐理由:官方公布了模型设计、RL 训练细节和评测数字,读者可以借此了解并行上下文检索的实现路径。
Cognition 的 Devin 可将 .NET Framework 到 .NET Core 的 Strangler Fig 迁移从数月缩短至最快两周。Devin 通过 DeepWiki 生成架构文档、Ask Devin 产出迁移计划、独立环境执行迁移并实时验证每个 PR,覆盖依赖共享、控制器、视图和 Session State 等环节。
Cognition 发布面向软件工程的 SWE-1.5 模型,参数量为数千亿级,与 Cerebras 合作以最高 950 tok/s 推理,比 Haiku 4.5 快 6 倍、比 Sonnet 4.5 快 13 倍,现已在 Windsurf 上线。
推荐理由:原文给出速度对比、SWE-Bench Pro 成绩和训练细节,读者可以据此评估这款高速编码模型是否改变现有工作流。
Cognition 发布 Windsurf Codemaps,由 SWE-1.5 和 Claude Sonnet 4.5 驱动的 AI 标注结构化代码地图,用于帮助工程师快速理解代码库。
Cognition 在 Devin 上线 18 个月之际发布年度绩效复盘,称其已进入数千家公司的工程团队,累计合并数十万个 PR。
推荐理由:Cognition 以自家客户数据和指标复盘 Devin 的强弱项,为评估智能体实际部署效果提供了可参照的框架。
Infosys 与 Cognition 达成合作,将在其组织内部及全球客户群中部署 AI 软件工程师 Devin,先在金融服务业务落地,覆盖银行、支付、资本市场、保险和财富管理场景,再扩展至零售、能源、医疗等行业。
Cognition 发布 Devin Review,一款面向 GitHub PR 的 AI 代码审查工具,认为代码审查已成为比代码生成更大的瓶颈。
推荐理由:原文给出了 Devin Review 的三种使用入口和具体功能细节,读者可以据此判断它如何改进自己的 PR 审查流程。
Cognition 在伦敦开设办公室,将自主软件工程推向欧洲领先企业。过去一年,全球多家大型金融机构已采用 Devin 覆盖 SDLC 工作,包括大规模现代化与迁移、安全漏洞修复以及复杂代码库文档化,Cognition 的合作伙伴包括 Goldman Sachs、Santander、Citi、BNY、HG Capital 和 The Access Group 等。
Cognizant 与 Cognition 达成合作,将在其工程组织和全球客户中部署 Devin 与 Windsurf。Cognizant 工程师已使用 Windsurf IDE 进行智能体辅助的流式编码,并正在探索 Devin 在代码迁移、重构、测试和维护等工程工作流中的自主端到端执行能力。
Cognition 为 Devin 推出 bot triggers 功能:Devin 可被配置为自动修复 Devin Review 及其他 review bot 在 PR 上留下的评论,并继续自动修复 lint 和 CI/CD 问题。
推荐理由:原文由官方说明功能配置入口和适用范围,读者可以判断它如何改变团队 PR 审查流程。
Cognition 发布 Devin 2.2,称其为 Devin 上线以来最重要的更新之一。Devin 现在可用自己的 Linux 桌面启动和测试桌面应用,PR 后可回传屏幕录制供人审查;同时能自审输出并自动修复问题,启动速度提升 3 倍,界面全面重构。新用户可获 $10 额度免费使用,新会话默认开启 Desktop 支持。
Cognition 推出 Cognition for Government,将 AI 软件工程平台引入美国联邦政府 IT 现代化。其 Devin 智能体可在云端并行执行数百个任务,迁移速度比人类工程师快 5-40 倍,现已上线 AWS GovCloud,FedRAMP High 授权版本即将推出。
Cognition 官方博客介绍其团队如何用 Devin 构建 Devin 本身:上周合并了 659 个 Devin 提交的 PR,高于 2025 年最佳单周的 154 个。
Cognition 分享正在训练中的 SWE-1.6 早期预览:当前 checkpoint 在 SWE-Bench Pro 上比 SWE-1.5 高 11%(51.7% 对 40.1%),推理速度同为 950 tok/s,并向小部分用户开放早期访问。
Cognition 宣布 Devin 可将大任务拆分并委派给多个受管理的 Devin 并行执行,每个子 Devin 在独立虚拟机中运行,拥有自己的终端、浏览器和开发环境。主 Devin 会话作为协调者负责拆分、分配、监控和汇总,并能读取子会话完整轨迹以改进后续任务拆分;同时支持向子会话发消息、监控 ACU 消耗、暂停或终止子会话。该功能现已向所有用户开放。
Cognition 宣布 Devin 可以调度自己的周期性会话:用户描述需求或让 Devin 完成一次任务后,直接告诉它按周期重复,Devin 会自行确定节奏并设置日程,无需配置 cron 或工作流工具。
Cognition 发布面向软件工程智能体的新模型 SWE-1.6,已在 Windsurf 全面开放,未来 3 个月免费。模型针对智能水平和模型 UX 联合训练,相比 Preview 减少了过度思考、循环行为和串行工具调用,更多使用并行工具调用;训练中引入长度惩罚以抑制过长轨迹。
Cognition 发文说明 Devin 在多家财富 500 强企业承担 COBOL 项目的做法与成效。文章指出 COBOL 对智能体的三大难点:业务数据靠内存位置而非命名关联、LLM 几乎没有 COBOL 训练语料、COBOL 依赖大型机导致反馈循环失效;应对方式是先用 DeepWiki 建立系统级代码地图,再用 playbook 编码领域约束。
Cognition 宣布成立 Cognition Japan,这是其首次进入亚洲市场,并任命在 IBM、Microsoft、Workday、Datadog Japan 任职过的 Takumi Masai 为日本总裁兼总经理。
Cognition 宣布更新 Devin 的自助定价,停用旧 Core 和 Team 套餐,推出 Free、Pro($20/月)、Max($200/月)、Teams(用量计费,最低 $80/月)和 Enterprise 五档,Team 入口从 $500/月降低。
Cognition 与 Applied Compute 合作 RL 训练了专用 bug 检测模型 SWE-check,在内部 in-distribution 评测中对 Opus 4.6 的 delta F1 从 0.09 降到 0,out-of-distribution 的 delta F1 从 0.49 降到 0.29,同时运行时间快约 10 倍且推理更便宜。
Cognition 发布 Devin in Windsurf,在 Windsurf 2.0 中内置本地与云端 Agent 协作流程。用户在 Windsurf 本地理解代码库并制定计划,一键发送给云端 Agent Devin 执行,Devin 自行启动机器、打开 PR、运行测试并用计算机视觉做 QA,用户可在 Windsurf 内查看 diff、跑测试或交回本地 Agent 修改。
Cognition 发布长文复盘,认为多智能体系统目前只在写入保持单线程、其他智能体贡献智能的模式下有效。
推荐理由:Cognition 一线团队复盘了真正跑通的多智能体模式,给出干净的审查上下文和单线程写入等可迁移经验。
Cognition 基于两年多构建 Devin 的经验,指出容器化方案存在共享内核安全风险,也无法跨异步间隙保存状态,他们用 microVM 隔离和 hypervisor 级全机状态快照解决。
Cognition 发布 Devin CLI,可把 Devin 作为本地编码智能体在终端运行,通过 curl -fsSL https://cli.devin.ai/install.sh | bash 一分钟内安装。
推荐理由:发布方自述了本地会话与云端接力的具体玩法,读者可以据此评估是否把它接入自己的终端工作流。
Mercedes-Benz 与 Cognition 达成合作,在全球工程团队部署 Devin 和 Windsurf,覆盖美国、欧洲和亚洲,是汽车行业规模最大的 AI 软件工程部署之一。