browser-use 发布 browser-agent-template:可一键部署的 Vercel 网页浏览智能体模板
browser-use 推出 browser-agent-template,这是一个可 fork 并部署到 Vercel 的智能体模板,通过 Browser Use 云端浏览器浏览网页。该模板面向快速搭建网页浏览类 AI 智能体场景,用户可直接 fork 后部署使用。
browser-use 推出 browser-agent-template,这是一个可 fork 并部署到 Vercel 的智能体模板,通过 Browser Use 云端浏览器浏览网页。该模板面向快速搭建网页浏览类 AI 智能体场景,用户可直接 fork 后部署使用。
browser-use 发布 eve,通过 npm 包和脚手架让 Vercel eve agent 接入 Browser Use 云端浏览器。该工具以 npm package + scaffold 形式提供,供开发者为 eve agent 配置云端浏览器能力。
Hugging Face 在 GitHub 新建 huggingface/sagemaker-python-sdk 仓库,这是一个用于在 Amazon SageMaker 上训练和部署机器学习模型的库。
Midjourney 为 V8.1 推出 Draft mode,每次生成 24 张低分辨率低质量图片,消耗的 fast hours 为 V8.1 SD 任务的一半,可对选中图片点击 Vary 以全质量全分辨率渲染,通过菜单栏 ⚡ 按钮开启。
Google Research 发布矢量化数据集,将 Farmscapes 2020 的高分辨率栅格地图转化为可操作的树篱、石墙与林地清单,覆盖英国超 13 万平方公里。
🚀 MiMo Claw is LIVE Flagship AI Model + Kingsoft Office Integration 🤖 Unlock the Full Power of Agents • Powered by MiMo’s flagship model for reliable long-running tasks • 40–60% lower token consumption than comparable solutions, delivering better long-term value 📄 Productivity, All in One Place • Supports Word, Excel, PowerPoint, and PDF workflows • Generate professional documents, spreadsheets, and presentations with built-in templates 🎁 Expanded Free Benefits • Free to get started • Daily usage expanded from 1 hour to 4 hours • Fully cloud-based with zero deployment required 💰 Limited-time subscription: ¥14.9/month 👉 Try Now: https://aistudio.xiaomimimo.com/#/ 👉 Subscribe: https://platform.xiaomimimo.com/token-plan
Hugging Face 在 GitHub 新建 huggingface/kernels-test 仓库,用于存放测试内核的来源。该仓库目前仅包含测试内核的源文件,未披露具体内核类型或功能细节。
vLLM Semantic Router 团队发布 Fusion API,让一条路由可以运行多个面板模型、由 judge 模型分析共识与分歧并合成单个回答。
Sierra 于 3 月推出 Ghostwriter,让构建和优化 AI 智能体无需点击或写代码,只需描述需求。三个月后,支持主管、运营经理、QA 团队等从未写过代码的人开始直接改进客户体验。Sierra 同时推出优化智能体的 Explorer,持续分析客户对话并找出客户流失、处理不佳的问题及 CSAT 下滑点,再由 Ghostwriter 将洞察转化为改进。
Modem 面向所有用户开放 Zendesk 集成 beta 版,可在 Settings → Integrations → Zendesk 中通过 OAuth 连接。
browser-use 上线 plugins 仓库,为编码智能体提供 browser-harness 和 video-use 两款插件。该仓库托管在 GitHub,具体功能与用法尚未在现有信息中展开。
Hugging Face 推出 agent-collabs,用于快速搭建协作式自动研究项目所需的基础设施。该仓库帮助用户快速完成环境配置,以运行多智能体协作的自动研究流程。
Hugging Face 在 GitHub 发布 huggingface/sandbox-server 新仓库,为 'hf sandbox' 提供沙盒内静态服务器,支持命令执行、文件传输和端口转发,运行于 Hugging Face Jobs。
vLLM 宣布对 MiniMax M3 家族的 day-0 支持,涵盖 MiniMaxAI/MiniMax-M3 与 MiniMax-M3-MXFP8 两个检查点,支持 1M token 上下文和图像、视频多模态输入。
推荐理由:vLLM 团队自己拆解了 day-0 支持背后的 MSA 内核、缓存和部署细节,读者可以按需套用其部署配方。
Hugging Face 在 GitHub 上线新仓库 tau,将 Pi 的极简编程智能体移植为 Python 版本。该仓库定位为 Pi 编程智能体的 Python 实现,目前公开信息仅说明其为移植项目。
Hugging Face 上线新仓库 mlclaw,用于在 Hugging Face 平台上部署 OpenClaw 智能体。该仓库名为 huggingface/mlclaw,目前仅披露了部署 OpenClaw agents 这一用途。
小米 MiMo 发布并开源终端编程智能体 MiMo Code V0.1,采用 MIT 许可,内置 MiMo V2.5 多模态模型(限时免费、百万 token 上下文)。
推荐理由:官方宣布 MiMo Code V0.1 开源,列出无限上下文、语音输入等具体能力和一行安装命令,可据此评估迁移成本。
Google DeepMind 与 vLLM 团队合作,将 26B 参数、基于 Gemma4 的离散扩散语言模型 DiffusionGemma 接入 vLLM,这是 vLLM 首个原生支持的 dLLM。
推荐理由:原文详解了扩散语言模型的解码机制和 vLLM 的 ModelState 接入方案,并给出 H200 上的吞吐数据,对推理工程实践有直接参考价值。
Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,支持 70+ 语言的近实时语音到语音翻译,自动检测语言并保留说话人的语调、节奏和音高,全程仅落后说话人数秒。
推荐理由:原文来自 Google DeepMind 官方博客,说明了 Gemini 3.5 Live Translate 的能力细节和各端开放入口,读者可据此评估实时语音翻译的实际可用范围。
vLLM 社区发布开源 RL 后训练框架 vime(Apache 2.0),基于 slime 的训练栈和数据生成设计,将 Megatron 训练与 vLLM 推理接入同一条解耦管线。
Google 在 Gemini Enterprise Agent Platform 上推出基于 Agentic RAG 的 Cross-Corpus Retrieval,通过多智能体协作处理多源、多跳查询,相比标准 RAG 在事实性数据集上准确率最高提升 34%。
vLLM Semantic Router 发布 v0.3 版本 Themis,推出规范化 v0.3 配置契约、投影机制和首个生产可用的会话感知智能体路由(SAAR),并强化协议兼容、仪表盘运维控制台与 CLI。
推荐理由:版本把信号、投影、决策到模型选择收敛为统一契约,并引入会话感知路由,适合关注生产级流量治理的团队参考。
Modem 面向所有用户开放 Notion 集成,智能体可创建页面、填充数据库行、更新属性并向已有页面追加内容,所有写入操作均需用户确认后执行。该集成通过 OAuth 授权,访问令牌加密存储,可在 Settings 中随时断开。用户还能把 Notion 中的文档、PRD 等资料结合技能与自动化,构建 UTM 生成、Bug 分诊、客户研究等智能体工作流。
Alibaba 在 GitHub 发布 loongsuite-pilot,一个 local-first 的 AI 编码 Agent 遥测收集器,统一以 OpenTelemetry 事件收集 Claude Code、Codex、Cursor 等工具的数据。它提供 token 用量、成本、traces 和安全审计,并可导出到任意目的地。
OpenAI 在 GitHub 新建 openai/sites 仓库,用于托管 ChatGPT Sites 的 TypeScript 包。该仓库目前仅说明这一用途,未披露具体包名、版本号或功能细节。
OpenAI 在 GitHub 上线 openai/role-specific-plugins 仓库,提供面向不同角色的 Codex 插件模板。仓库内容为角色专用的 Codex plugin templates,具体角色划分与模板数量原文未披露。
vLLM Semantic Router 新增会话感知智能体路由(SAAR),在语义路由之上加入路由器会话记忆、工具循环硬锁、安全重置边界、前缀缓存感知的切换定价与可回放轨迹。在 21,600 个确定性轮次中,SAAR 将模型切换减少 79.29%,消除 3,836 次不安全切换,物理模型成本估算降低 78.71%;在 2,896 个 AMD ROCm 实时请求中保持会话连续性,未观察到违规。
QwenLM 发布 open-computer-use,一个基于 MCP 的 Computer Use 服务,供 Qwen Code 及任何 AI Agent 使用。它通过辅助功能 API 控制 macOS、Linux 和 Windows 系统。
推荐理由:原文点明该服务基于 MCP、可跨三大操作系统控制电脑,读者可以据此评估它与 Qwen Code 等 Agent 的结合方式。
Google Research 在 I/O 2026 上发布 Gemini for Science 科研工具套件,包含基于 ERA 与 AlphaEvolve 的 Computational Discovery、基于 Co-Scientist 的 Hypothesis Generation 以及基于 NotebookLM 的 Literature Insights。
Mistral 发布统一 AI 智能体 Vibe,Le Chat 整体升级为 Vibe,原有对话、设置与套餐全部迁移。Work Mode 处理跨企业工具的多步骤长任务,如邮件日历跟进、深度研究、文档撰写和定时任务;Code Mode 从网页发起远程编码会话直至生成 PR,并推出 VS Code 扩展和更新的 CLI(新增 /teleport、权限控制等)。
推荐理由:官方发布说明写清了 Le Chat 升级为 Vibe 后的工作与编码两大模式、各端入口和定价,可据以评估是否替换现有工作流。
Mistral AI 发布开源 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架。
推荐理由:原文给出框架的具体模块构成、内置检索与评测指标,以及可复用的 starter 模板命令,读者可据此评估是否替代自建检索管线。
DeepSeek 在 GitHub 新建仓库 clangd-ascend,为昇腾(Ascend)平台提供基于 clangd 的代码检查与代码补全能力。该仓库定位为 Clangd for Ascend,用于 Code Lint 与 Code Completion。
Midjourney 改进 Web 端对话模式,语音会话启动时可访问 Image Prompts、Style References、侧边栏设置和最近任务,Image Prompts 现可从托盘和侧边栏使用,托盘图片在语音提交间保留。
Nous Research 在 GitHub 上线 Automodel,这是一个基于 PyTorch 原生分布式、面向 LLM 与 VLM 的训练库,开箱即支持 Hugging Face。
Mistral 将 Emmi AI 团队纳入麾下,推出面向工业工程的物理 AI 基础能力,可从几何与边界条件直接预测完整物理场,单 GPU 单次前向推理将仿真从数小时压缩到秒级。该能力面向设计迭代而非替代传统求解器,合作方包括 ASML、Airbus、Safran 和 Siemens Energy,覆盖产品设计、工装工艺与实时数字孪生三类场景。
OpenAI 在 GitHub 上线新仓库 openai/fence,项目名称取自"围栏"概念——既阻挡外部事物,也将其内部事物围住。该仓库目前仍处于早期且活跃的开发阶段。
OpenAI 在 GitHub 新建 openai-developers-for-cursor 仓库,为 Cursor 提供 OpenAI Developers 插件。
Hugging Face 发布新仓库 huggingface/jobs-actions,支持在 Hugging Face Jobs 上运行 GitHub Actions。该工具将 GitHub 的 CI/CD 工作流接入 Hugging Face 的计算任务环境。
Hugging Face 推出 aokit,一个面向 PyTorch 的轻量级提前编译(ahead-of-time compilation)工具包。该工具包已在 HF Spaces 上结合 ZeroGPU 的演示中被大量使用。