跳到正文

#产品更新

今日 75 条
9月30日周三
  1. Cognition 模型 / Devin 博客(网页)64

    Cognition 为 Claude Sonnet 4.5 重构 Devin,速度提升 2 倍并在 Agent Preview 上线

    Cognition 为 Claude Sonnet 4.5 重构了 Devin,新版本速度快 2 倍,Junior Developer Evals 提升 12%,现已开放 Agent Preview,旧版 Devin 仍可使用。团队观察到该模型会感知自身上下文窗口、主动写笔记和并行执行工具调用,为此调整了提示词和记忆管理架构,并分享了子智能体、元智能体提示词等后续探索方向。

  2. Cognition 模型 / Devin 博客(网页)28

    用 Devin 自动化 .NET Framework 到 .NET Core 迁移

    Cognition 的 Devin 可将 .NET Framework 到 .NET Core 的 Strangler Fig 迁移从数月缩短至最快两周。Devin 通过 DeepWiki 生成架构文档、Ask Devin 产出迁移计划、独立环境执行迁移并实时验证每个 PR,覆盖依赖共享、控制器、视图和 Session State 等环节。

  3. Cognition 模型 / Devin 博客(网页)60

    Cognition 发布 Devin 2.2,支持桌面测试、自审与自动修复

    Cognition 发布 Devin 2.2,称其为 Devin 上线以来最重要的更新之一。Devin 现在可用自己的 Linux 桌面启动和测试桌面应用,PR 后可回传屏幕录制供人审查;同时能自审输出并自动修复问题,启动速度提升 3 倍,界面全面重构。新用户可获 $10 额度免费使用,新会话默认开启 Desktop 支持。

  4. Cognition 模型 / Devin 博客(网页)64

    Devin 支持管理多个 Devin 并行执行任务

    Cognition 宣布 Devin 可将大任务拆分并委派给多个受管理的 Devin 并行执行,每个子 Devin 在独立虚拟机中运行,拥有自己的终端、浏览器和开发环境。主 Devin 会话作为协调者负责拆分、分配、监控和汇总,并能读取子会话完整轨迹以改进后续任务拆分;同时支持向子会话发消息、监控 ACU 消耗、暂停或终止子会话。该功能现已向所有用户开放。

  5. Cognition 模型 / Devin 博客(网页)63

    Devin 支持定时调度自己的会话

    Cognition 宣布 Devin 可以调度自己的周期性会话:用户描述需求或让 Devin 完成一次任务后,直接告诉它按周期重复,Devin 会自行确定节奏并设置日程,无需配置 cron 或工作流工具。

  6. Cognition 模型 / Devin 博客(网页)59

    Cognition 推出 Devin in Windsurf,Windsurf 2.0 内置本地加云端 Agent 工作流

    Cognition 发布 Devin in Windsurf,在 Windsurf 2.0 中内置本地与云端 Agent 协作流程。用户在 Windsurf 本地理解代码库并制定计划,一键发送给云端 Agent Devin 执行,Devin 自行启动机器、打开 PR、运行测试并用计算机视觉做 QA,用户可在 Windsurf 内查看 diff、跑测试或交回本地 Agent 修改。

  7. Cognition 模型 / Devin 博客(网页)70

    Cognition 发布 Devin Desktop,作为 Windsurf 下一代版本

    Cognition 发布 Devin Desktop,定位为 Windsurf 的下一代版本,将 Agent Command Center 设为 IDE 默认界面,可从一处管理本地与云端 Agent、PR 和上下文。

    推荐理由:官方完整说明了产品定位与 ACP 开放设计,读者可以据此判断它与现有 Windsurf 工作流的衔接方式。

  8. Cognition 模型 / Devin 博客(网页)68

    Cognition 发布 Devin Fusion:混合模型架构以最高 60% 更低成本保持前沿编码性能

    Cognition 推出 Devin Fusion 预览,一个混合模型 harness,通过并行前沿模型与低成本 sidekick 智能体、以及基于轻量分类器在上下文压缩时动态切换模型。

    推荐理由:官方披露了 sidekick 双智能体与中途动态路由两类可参考的降本架构,并给出 FrontierCode 上的成本与性能数据。

  9. Cognition 模型 / Devin 博客(网页)53

    Cognition 发布 Devin Security Swarm

    Cognition 发布 Devin Security Swarm,可扫描代码库发现漏洞、在运行时验证可利用性并提交修复 PR。它用并行 Agent 跨文件推理业务逻辑缺陷和链式攻击路径,在隔离沙箱中复现后开 PR。

  10. Baseten 工程博客(网页)21

    Baseten 推出 Embeddings 推理服务:支持任意嵌入模型与弹性扩缩容

    Baseten 上线 Embeddings 服务,可用任意嵌入模型快速处理数百万数据点,支持自定义 Docker 镜像、Truss 库和 Baseten Chains。该服务覆盖 BGE、Stella、SFR-Embedding、Nomic、NV-Embed、Voyage 等模型系列,面向语义搜索与推荐系统,提供五个 9 可用性、优化冷启动和弹性自动扩缩容,可缩容至零以节省成本。

  11. Baseten 工程博客(网页)18

    Baseten 图像生成推理服务:支持 FLUX.1 dev 与 SDXL Lightning

    Baseten 推出面向图像生成模型的推理服务,支持部署 FLUX.1 dev、SDXL Lightning 等开源模型及用户微调、自定义模型,兼容 ComfyUI 等框架。SDXL Lightning 可在 4 个 UNet 步内生成 1024x1024 图像,接近实时出图。平台提供弹性自动扩缩容、冷启动优化,并支持 SOC 2 Type II、HIPAA、GDPR 合规部署。

  12. Baseten 工程博客(网页)21

    Baseten 的前向部署工程师:从 POC 到规模化的嵌入式推理支持

    Baseten 推出前向部署工程师(forward deployed engineers)团队,以嵌入式工程方式帮客户架构系统、部署并优化模型。该团队提供跨云自动扩缩容与 99.99% 可用性保障,并针对不同模态应用推理栈优化,代码归客户所有。服务覆盖从 POC 到规模化的全过程,持续引入社区最新研究优化性能与成本。

  13. Baseten 工程博客(网页)35

    Baseten 推出 Hybrid 混合部署方案:VPC 自托管与 Baseten Cloud 无缝溢出

    Baseten 发布 Hybrid 混合部署方案,让模型推理在自有 VPC 内运行,并在流量高峰时无缝溢出到 Baseten Cloud。该方案支持多云端路由、区域锁定数据驻留与快速冷启动,可沿用现有云资源承诺以优化成本,并继承 Baseten Cloud 的 SOC 2 Type II、HIPAA 和 GDPR 合规能力。

  14. Baseten 工程博客(网页)23

    Baseten 推出自托管部署方案,支持在自有 VPC 内运行推理

    Baseten 推出 Self-hosted 部署方案,让企业在自有 VPC 内获得与托管服务一致的毫秒级低延迟和高吞吐推理,模型输入输出不会经过 Baseten 服务器。该方案支持数据驻留与区域锁定部署,可满足 GDPR、HIPAA 等合规要求,并允许使用自有硬件或现有云厂商 credits 与 commits 优化成本。

  15. Baseten 工程博客(网页)48

    Baseten 推出多云容量管理 MCM,覆盖 20+ 云与区域

    Baseten 为 20 多个云和区域构建了多云容量管理(MCM),支撑低延迟与 99.99% 可用性。MCM 通过 SLA 感知的自动扩缩容,把跨云 GPU 资源视为可互换,实现跨云动态路由与扩缩模型副本,以应对云故障和容量限制。该能力支持数据驻留与主权合规,可运行在 Baseten Cloud、自托管或混合模式中。

  16. Baseten 工程博客(网页)24

    Baseten 推出跨云自动扩缩容推理基础设施

    Baseten 发布面向推理优化的基础设施,支持多节点、多云、多区域部署,通过跨云自动扩缩容让模型在全球低延迟服务,并以跨云容量管理实现四个九可用性。其自动扩缩容器实时匹配流量与资源,冷启动优化可在数秒内拉起新副本,并提供自托管、云和混合三种部署方式。

  17. Baseten 工程博客(网页)18

    Baseten Inference Runtime:可配置的模型推理运行时

    Baseten 推出 Inference Runtime,将 TensorRT、SGLang、vLLM、TGI、TEI 等开源推理框架与自研优化整合进单一可配置运行时,宣称可在数分钟内完成配置。该运行时原生支持 Medusa、Eagle 等投机解码技术,并通过 KV cache 卸载与缓存感知路由、prefill 优先调度、TP 与 EP 混合并行等手段降低延迟。

  18. Augment Code 博客(网页)65

    Augment 发布 Prism 模型路由,按任务分流降低成本

    Augment Code 推出 Prism,一种模型路由选项,为每轮用户请求自动选择底层模型,称团队月发 1 万次请求可省约 2 万美元,成本最多降 30%,质量与所对标的前沿推理模型差异可忽略。

    推荐理由:官方给出多基准成本与质量数据及缓存感知路由方法,读者可据此评估模型路由能否降低自己的智能体开销。