Sierra 收购日本企业 AI 初创公司 Opera Tech
Sierra 宣布收购东京企业 AI 初创公司 Opera Tech,其联合创始人森川馨太与國井清人将加入 Sierra。Sierra 称日本是对企业软件要求最高的市场之一,Opera 团队拥有服务日本大型企业的本地关系与经验。
Sierra 宣布收购东京企业 AI 初创公司 Opera Tech,其联合创始人森川馨太与國井清人将加入 Sierra。Sierra 称日本是对企业软件要求最高的市场之一,Opera 团队拥有服务日本大型企业的本地关系与经验。
Modem 面向所有用户上线 Intercom 集成,通过 webhooks 实时将对话、回复、内部笔记、状态变更和 CSAT 评分汇入其 topic 系统,并与 Slack、Discord、GitHub 讨论并列。
Sierra 发布 Ghostwriter,一个能构建智能体的智能体,用户通过自然语言、SOP、通话记录等输入即可生成覆盖语音、聊天、邮件及 30 多种语言的 production-ready 客服 Agent。
Sierra 宣布在澳大利亚悉尼开设办公室,此前已扩展至新加坡、东京、马德里、巴黎和伦敦。其平台上的 AI 智能体支持 30 多种语言、全天候无等待服务,覆盖产品发现、注册登录、故障排查和流失管理。美国 Rocket Mortgage 每月贷款规模达 $1BN,使用其智能体的购房者完成流程的可能性高出四倍。
上海人工智能实验室 InternLM 项目推出 WildClawBench,一个面向生产环境(production harness)中 AI 智能体的 in-the-wild 基准测试。该基准聚焦智能体在真实部署环境下的表现评估,目前随 InternLM 项目开源发布。
OpenAI Alignment 团队提出 self-incrimination 训练方法,让智能体在暗中失范时主动调用 report_scheming() 工具自报行为。
Sierra 发布 𝜏³-Bench,在 𝜏-Bench 基础上新增 𝜏-Knowledge 和 𝜏-Voice 两个评测域,并合并社区对原有领域的修正。
Modem 面向所有用户上线 PostHog 集成,连接后其智能体可通过 API 实时查询产品分析、功能开关和 A/B 实验数据。用户用自然语言提问,智能体自动生成查询并返回事件计数、漏斗、留存、HogQL 趋势及实验统计显著性结果,还可与 Modem 的 topic 数据交叉比对。
Together AI 扩展 Together Fine-Tuning,新增工具调用、推理和视觉语言模型(VLM)微调支持,训练栈升级后支持 100B+ 参数模型,吞吐最高提升 6×,数据集支持最大 100GB。
Google Research 在 The Check Up 活动上公布多项医疗 AI 进展,包括与 Fitbit 合作研究的 Personal Health Agent(PHA),可整合数据科学家、领域专家与健康教练角色提供长期健康支持。
Mistral AI 推出 Forge,让企业基于自有专有知识训练前沿级 AI 模型,支持预训练、后训练与强化学习全流程。Forge 同时支持 dense 与 MoE 架构,并可按需支持多模态输入,模型可运行在企业自有基础设施内以保留控制权。该平台以智能体优先设计,Mistral Vibe 等自主智能体可用其微调模型、寻找最优超参数、调度任务并生成合成数据。
Mistral 发布 Leanstral,一个面向 Lean 4 的开源代码智能体,权重以 Apache 2.0 许可开放,同时在 Mistral Vibe 中以 agent 模式提供,并通过免费 API 端点 labs-leanstral-2603 开放。
推荐理由:原文给出 FLTEval 分数和与 Claude 系列的成本对比,读者可据此评估它在形式化证明工程中的性价比。
Together AI 在 NVIDIA GTC 2026 上宣布多项进展:其推理栈已采用 NVIDIA Dynamo 1.0,并与 NVIDIA 合作推出基于 NemoClaw 和 OpenShell 运行时的智能体部署方案。
对话式 AI 平台 Sierra 宣布在西班牙马德里开设办公室,并已与多家西班牙大型企业合作构建 AI 客户体验。Sierra 智能体可覆盖产品推荐、注册、账户管理、故障排查、忠诚度计划与流失管理等场景。其客户 Next 六周上线、覆盖 83 个国家 48 种语言,Cigna 八周投产并将患者认证时间缩短 80%,Singtel 十周上线、解决率超 70%。
Together AI 推出统一方案,在同一集群内共同部署 STT、LLM 和 TTS 基础设施来构建实时语音智能体,端到端延迟低于 500 毫秒(从用户说话结束到首个音频 token)。
Modem 面向所有用户上线 Event Automations,让自动化不再按时间表运行,而是在事件发生时唤醒同一个 Modem Agent 执行提示词。
Mistral AI 基于 open-source 编码助手 Vibe 构建了一个自主智能体,可读取 Rails 源文件、生成或改进 RSpec 测试,并通过 RuboCop 和 SimpleCov 自定义工具在 CI/CD 中无人工干预运行。
推荐理由:Mistral 详述了在 Vibe 上构建 Rails 测试智能体的上下文工程与自定义工具方案,给出可复用的步骤和实测分数。
NVIDIA Nemotron 3 Super 登陆 Together AI,模型为 120B 参数(12B 激活)、Transformer 与 Mamba 混合 MoE 架构,支持 1M-token 上下文窗口,生成速度较当前领先开源模型高 50% 以上。
Together AI 在首届 AI Native Conf 上发布七项研究与产品成果,覆盖 Kernels、强化学习与算法推理优化三个方向。
OpenAI 发布 Codex 模型(API 中为 gpt-5.3-codex)的提示词指南,推荐 medium 推理力度作为交互编码的平衡选择,高难度任务可用 high 或 xhigh。
推荐理由:官方给出从 GPT-5 系列迁移到 gpt-5.3-codex 的提示词、工具和 phase 参数细节,可直接照做。
Answer.AI 的 Piotr Czapla 报告,Claude Opus 4.6、Sonnet 4.5、Haiku 4.5 会幻觉调用未被授予的工具(如 read_secret、GitHub MCP 的 get_me),且 API 不拦截;在 Gemini、Grok 上也能复现类似行为。
推荐理由:作者实测多家模型会调用未授权工具且 API 不拦截,指出这会瓦解能力分离防御,并给出客户端校验的简单修复。
Sierra 构建了 Multi-Model Router(MMR)与拥塞感知的 provider 选择器两层基础设施,在 provider 出现限流或故障时保持智能体行为一致。
Modem 完成 440 万美元融资,由 Accel 领投、Inovia Capital 参投,用于打造面向智能体编程时代的自动分诊产品经理。Modem 可连接 Slack、Discord、GitHub、Linear、email 等渠道,从产品讨论中构建上下文图谱,自动将杂乱对话归类为结构化主题并排定优先级,无需手动打标签或分诊。
Sierra 在进入第三年之际宣布 ARR 超过 1.5 亿美元,此前用七个季度达到 1 亿美元 ARR,并迎来首个 5000 万美元季度。
OpenAI 发布 Codex app,定位为基于智能体构建软件的指挥中心。它支持并行运行多个智能体并用 worktrees 隔离各自改动,可将工具和约定打包成可复用的 skills,还支持通过后台定时工作流把重复性工作交给 Codex。目前提供 macOS 下载(https://openai.com/codex),Windows 支持即将推出。
推荐理由:视频给出了 Codex app 的并行多任务、skills 打包和后台自动化等能力与 macOS 下载入口,读者可据此评估其对现有开发流程的影响。
Mistral AI 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的重大升级,由 Devstral 2 模型系列驱动。新增自定义 subagents、多选项澄清、slash 命令技能、统一 agent 模式和自动更新;产品现已在 Le Chat Pro 和 Team 套餐开放,支持按量付费或自带 API key。
推荐理由:官方宣布 Mistral Vibe 2.0 上线,列出 subagents、slash 命令技能等新能力和 Le Chat Pro/Team 套餐与 Devstral 2 定价,读者可据此评估工作流适配。
上海人工智能实验室 InternLM 推出 EMemBench,一个面向 VLM 智能体的情景记忆交互式基准,论文已被 EMNLP 2026 Findings 收录。该基准以交互方式评测智能体的情景记忆能力,官方仓库已同步开放。
Sierra 发布 Expert Answers,可在 AI 智能体遇到知识缺口、转交人工客服解决后,自动从该次解决过程生成可审核的知识草稿并回灌给智能体。一家数字健康公司用其基于真实客服对话生成的文章做小流量测试,解决率提升 4% 且未增加客服工作量,随后全面铺开。该功能还可配合 Live Assist 将知识同步给整个客服团队。
Sierra 与 Stellarus 达成合作,帮助健康计划大规模部署 AI 智能体,双方与 Blue Shield of California 合作推出的 AI 语音智能体已运行六个月,在数千次会员互动中取得 4.4/5 的客户满意度评分。该智能体基于 Sierra 平台构建,可 24/7 解答福利与承保范围等问题,无需等待接通。双方下一步将从被动支持转向更主动的 AI 驱动互动。
Sierra 发布 Workspaces,把 GitHub、Figma 式的协作模式引入 AI 智能体开发,让团队成员在各自 Workspace 中并行构建、测试,再通过合并生成 snapshot 并发布到 QA、staging 或生产环境。
小米发布 MiMo-V2-Flash 基础模型,主打高效推理、编码与智能体能力。该模型以 MiMo-V2-Flash 为名在 GitHub 新仓库开源,具体参数规模、benchmark 分数与上下文长度尚未在现有信息中披露。
OpenAI 发布 GPT-5.2 提示词指南,称其在企业级和智能体工作负载中提升了准确性、指令遵循、token 效率和多模态理解,但默认 reasoning_effort 为 none 且仍对提示词敏感。
推荐理由:OpenAI 官方给出 GPT-5.2 的提示词模式与迁移步骤,开发者可以直接套用其中模板和 evals 流程。
Sierra 发布 Visual Attachments,让聊天智能体在对话中直接嵌入进度条、安全输入框、快捷按钮等可视化 UI 组件,无需替换对话即可缩短完成路径。这些组件用 React 构建、可在 Agent Studio 中零代码部署,并支持无障碍、响应式与可测量。Rocket Mortgage 的预资格智能体采用后,客户转接银行专员时的转化率在再融资和购房流程中均提升 4 倍。
Mistral AI 发布开源编码模型 Devstral 2(123B,修改版 MIT 许可)和 Devstral Small 2(24B,Apache 2.0),并推出开源命令行编码助手 Mistral Vibe CLI。
推荐理由:官方公布了两档开源编码模型的参数规模、SWE-bench Verified 成绩和定价,并说明各自部署门槛,可据此评估实际选用成本。
上海人工智能实验室 InternLM 团队发布 ARM-Thinker,通过智能体工具调用与视觉推理强化多模态生成式奖励模型,论文已被 CVPR 2026 收录,官方代码同步开源。
OpenAI 开发者 Cookbook 发布教程,演示在同一 Realtime WebSocket 会话上通过带外的 response.create 请求(conversation 设为 none。
Mistral AI 推出 Mistral AI Studio,一个面向企业团队的生产级 AI 平台,由 Observability、Agent Runtime 和 AI Registry 三大支柱组成。
OpenAI Developers 发布了一场实操演示,展示通过 AI 智能体和工具调用(tool calling)为代码库提速的工具链。演示以动手实操形式呈现,聚焦于提升编码速度。
内容讨论在 Cursor 中让 Codex 式智能体协作的上下文策略,核心围绕智能体与上下文窗口展开。