跳到正文

#产品更新

今日 9 条
9月30日周三
  1. Claude:Blog(网页)64

    Claude Managed Agents 记忆功能开启公测

    Anthropic 宣布 Claude Managed Agents 的记忆功能即日起以公测形式上线。记忆以文件形式挂载在文件系统上,智能体可跨会话学习并共享经验,记忆可通过 API 导出和管理,并带有权限范围、审计日志、版本回滚和内容修订等企业级控制。

    推荐理由:官方公告讲清了文件式记忆的机制和企业级控制能力,还给出多家团队的具体效果数字,便于评估对长时程智能体工作的价值。

  2. Claude:Blog(网页)64

    Claude Managed Agents 推出 dreaming 功能并开放 outcomes、多智能体编排与 webhooks

    Claude 官方宣布在 Managed Agents 中以研究预览形式推出 dreaming,通过回顾过往会话提取模式、整理记忆,让智能体随时间自我改进,开发者可申请访问。

    推荐理由:官方发布给出 dreaming、outcomes 与多智能体编排的能力细节和测试数字,读者可据此评估其在复杂任务工作流中的作用。

  3. Claude:Blog(网页)60

    Claude Code 推出 Artifacts:把会话工作变成可共享的实时网页

    Claude Code 推出 Artifacts,可基于会话完整上下文(代码库、连接器、对话)生成实时可共享的网页,如 PR 讲解、事故页、仪表盘和发布清单,页面随会话进展原地刷新,每次发布为新版本并支持历史回滚。

    推荐理由:官方说明了 Artifacts 的构建方式、版本共享机制和权限策略,读者可以判断它能否替换团队现有的状态同步流程。

  4. Claude:Blog(网页)69

    Claude 桌面端 Cowork 内置浏览器上线

    Claude 在桌面端 Cowork 中内置浏览器,任务需要访问网站时侧边栏会打开浏览器,由 Claude 导航、读取、点击和填写表单。浏览器与用户浏览器分离,不共享标签页、书签或密码,银行、邮箱和单点登录站点默认排除,企业版可由管理员开启,本周起向 Pro、Max 和 Team 计划推送。

    推荐理由:原文说明内置浏览器与 Claude in Chrome 的分工、隐私隔离和推送范围,读者可以据此判断哪种方式适合自己。

  5. Claude:Blog(网页)76

    Claude in Chrome 正式全面可用,支持在浏览器中自主执行操作

    Anthropic 宣布 Claude in Chrome 正式面向所有付费 Claude 计划开放,Claude 现在可以在浏览器中自主执行操作,无需每个动作都经人工批准,操作前由安全分类器校验其安全性并匹配用户请求。

    推荐理由:官方宣布 Claude in Chrome 全量开放并支持自主操作,同时给出提示注入防护机制与评测数据,便于读者评估其浏览器自动化能力。

  6. Claude:Blog(网页)64

    Claude for Small Business 新增 43 个工作流和 27 个集成,并重启 SMB 巡回培训

    Anthropic 为 Claude for Small Business 推出 43 个工作流和 27 个新集成,接入 Shopify、Salesforce、Stripe、Zoom、Xero 等工具,覆盖周报、线索响应、提案撰写、营销内容和月末关账等场景,产品自 5 月上线以来安装量超过 90 万次。

    推荐理由:官方公布了新增工作流和集成的具体数量与用户案例,读者可以对照自己的工具链判断是否值得接入。

  7. Cognition 模型 / Devin 博客(网页)64

    Cognition 为 Claude Sonnet 4.5 重构 Devin,速度提升 2 倍并在 Agent Preview 上线

    Cognition 为 Claude Sonnet 4.5 重构了 Devin,新版本速度快 2 倍,Junior Developer Evals 提升 12%,现已开放 Agent Preview,旧版 Devin 仍可使用。团队观察到该模型会感知自身上下文窗口、主动写笔记和并行执行工具调用,为此调整了提示词和记忆管理架构,并分享了子智能体、元智能体提示词等后续探索方向。

  8. Cognition 模型 / Devin 博客(网页)28

    用 Devin 自动化 .NET Framework 到 .NET Core 迁移

    Cognition 的 Devin 可将 .NET Framework 到 .NET Core 的 Strangler Fig 迁移从数月缩短至最快两周。Devin 通过 DeepWiki 生成架构文档、Ask Devin 产出迁移计划、独立环境执行迁移并实时验证每个 PR,覆盖依赖共享、控制器、视图和 Session State 等环节。

  9. Cognition 模型 / Devin 博客(网页)60

    Cognition 发布 Devin 2.2,支持桌面测试、自审与自动修复

    Cognition 发布 Devin 2.2,称其为 Devin 上线以来最重要的更新之一。Devin 现在可用自己的 Linux 桌面启动和测试桌面应用,PR 后可回传屏幕录制供人审查;同时能自审输出并自动修复问题,启动速度提升 3 倍,界面全面重构。新用户可获 $10 额度免费使用,新会话默认开启 Desktop 支持。

  10. Cognition 模型 / Devin 博客(网页)64

    Devin 支持管理多个 Devin 并行执行任务

    Cognition 宣布 Devin 可将大任务拆分并委派给多个受管理的 Devin 并行执行,每个子 Devin 在独立虚拟机中运行,拥有自己的终端、浏览器和开发环境。主 Devin 会话作为协调者负责拆分、分配、监控和汇总,并能读取子会话完整轨迹以改进后续任务拆分;同时支持向子会话发消息、监控 ACU 消耗、暂停或终止子会话。该功能现已向所有用户开放。

  11. Cognition 模型 / Devin 博客(网页)63

    Devin 支持定时调度自己的会话

    Cognition 宣布 Devin 可以调度自己的周期性会话:用户描述需求或让 Devin 完成一次任务后,直接告诉它按周期重复,Devin 会自行确定节奏并设置日程,无需配置 cron 或工作流工具。

  12. Cognition 模型 / Devin 博客(网页)59

    Cognition 推出 Devin in Windsurf,Windsurf 2.0 内置本地加云端 Agent 工作流

    Cognition 发布 Devin in Windsurf,在 Windsurf 2.0 中内置本地与云端 Agent 协作流程。用户在 Windsurf 本地理解代码库并制定计划,一键发送给云端 Agent Devin 执行,Devin 自行启动机器、打开 PR、运行测试并用计算机视觉做 QA,用户可在 Windsurf 内查看 diff、跑测试或交回本地 Agent 修改。

  13. Cognition 模型 / Devin 博客(网页)70

    Cognition 发布 Devin Desktop,作为 Windsurf 下一代版本

    Cognition 发布 Devin Desktop,定位为 Windsurf 的下一代版本,将 Agent Command Center 设为 IDE 默认界面,可从一处管理本地与云端 Agent、PR 和上下文。

    推荐理由:官方完整说明了产品定位与 ACP 开放设计,读者可以据此判断它与现有 Windsurf 工作流的衔接方式。

  14. Cognition 模型 / Devin 博客(网页)68

    Cognition 发布 Devin Fusion:混合模型架构以最高 60% 更低成本保持前沿编码性能

    Cognition 推出 Devin Fusion 预览,一个混合模型 harness,通过并行前沿模型与低成本 sidekick 智能体、以及基于轻量分类器在上下文压缩时动态切换模型。

    推荐理由:官方披露了 sidekick 双智能体与中途动态路由两类可参考的降本架构,并给出 FrontierCode 上的成本与性能数据。

  15. Cognition 模型 / Devin 博客(网页)53

    Cognition 发布 Devin Security Swarm

    Cognition 发布 Devin Security Swarm,可扫描代码库发现漏洞、在运行时验证可利用性并提交修复 PR。它用并行 Agent 跨文件推理业务逻辑缺陷和链式攻击路径,在隔离沙箱中复现后开 PR。

  16. Baseten 工程博客(网页)21

    Baseten 推出 Embeddings 推理服务:支持任意嵌入模型与弹性扩缩容

    Baseten 上线 Embeddings 服务,可用任意嵌入模型快速处理数百万数据点,支持自定义 Docker 镜像、Truss 库和 Baseten Chains。该服务覆盖 BGE、Stella、SFR-Embedding、Nomic、NV-Embed、Voyage 等模型系列,面向语义搜索与推荐系统,提供五个 9 可用性、优化冷启动和弹性自动扩缩容,可缩容至零以节省成本。

  17. Baseten 工程博客(网页)18

    Baseten 图像生成推理服务:支持 FLUX.1 dev 与 SDXL Lightning

    Baseten 推出面向图像生成模型的推理服务,支持部署 FLUX.1 dev、SDXL Lightning 等开源模型及用户微调、自定义模型,兼容 ComfyUI 等框架。SDXL Lightning 可在 4 个 UNet 步内生成 1024x1024 图像,接近实时出图。平台提供弹性自动扩缩容、冷启动优化,并支持 SOC 2 Type II、HIPAA、GDPR 合规部署。

  18. Baseten 工程博客(网页)21

    Baseten 的前向部署工程师:从 POC 到规模化的嵌入式推理支持

    Baseten 推出前向部署工程师(forward deployed engineers)团队,以嵌入式工程方式帮客户架构系统、部署并优化模型。该团队提供跨云自动扩缩容与 99.99% 可用性保障,并针对不同模态应用推理栈优化,代码归客户所有。服务覆盖从 POC 到规模化的全过程,持续引入社区最新研究优化性能与成本。