Hugging Face 发布 endpoints-custom-routers 仓库,为 Endpoints 自定义路由提供多种负载均衡策略
Hugging Face 在 GitHub 新建 endpoints-custom-routers 仓库,提供兼容 HF Endpoints 自定义路由功能的实现,内置多种负载均衡策略。该仓库面向 Endpoints 的自定义路由场景,具体策略种类与可用性原文未披露。
Hugging Face 在 GitHub 新建 endpoints-custom-routers 仓库,提供兼容 HF Endpoints 自定义路由功能的实现,内置多种负载均衡策略。该仓库面向 Endpoints 的自定义路由场景,具体策略种类与可用性原文未披露。
Alibaba 在 GitHub 发布 webmcp-nexus,一个面向 WebMCP 标准的非侵入式前端集成套件,开发者编写普通 TS 函数并添加 JSDoc 即可被任意 MCP 客户端调用。套件包含 SDK、Vite/Webpack 插件以及 AI 编码 Skill。
Mistral 发布 Mistral Medium 3.5(128B 密集模型,256k 上下文窗口,修改版 MIT 许可开源权重),并将其设为 Le Chat 和 Vibe CLI 的默认模型。
推荐理由:官方公布了模型规模、基准成绩与定价,并说明云端异步智能体如何嵌入现有工程工作流。
Mistral AI 在 Studio 发布 Connectors 公测,内置连接器和自定义 MCP 均可通过 API/SDK 用于所有模型和 Agent 调用。新功能包括直接工具调用、requires_confirmation 人工审批流和连接器的程序化管理;连接器 centrally 注册后可在 LeChat 和 AI Studio 间复用,并支持与 CRM、知识库等企业系统集成。
OpenBMB(清华 NLP)发布 PilotDeck,一个面向任务的 AI 智能体生产力平台。该仓库已上线 GitHub,定位为 task-oriented AI Agent productivity platform,具体功能与参数尚未披露。
OpenAI 在 GitHub 新建仓库 openai/imagegencam,定位为一台可用 Codex 自行搭建的数码相机。目前公开信息仅有仓库名与一句简介,尚未披露硬件规格、模型版本或可用性细节。
Google 发布 ERA 研究工具并宣布在 I/O 开始开放基于 AlphaEvolve 与 ERA 构建的 Computational Discovery,相关论文发表于 Nature。
推荐理由:原文给出 ERA 在多个学科基准上的专家级表现和八个应用案例,还提供了 Computational Discovery 的注册入口,读者可据此评估科学编码工具的实际进展。
Modem 向所有用户开放 Automation Templates,可在 Automations 页面浏览并一键安装经过测试的现成智能体自动化。安装后模板会生成预填提示词、调度和输出目标的自动化,未编辑提示词时还能随官方改进持续更新,用户也可随时 fork 自行定制。模板覆盖 GitHub PR 合并后通知 Slack、每日新面孔识别、每周更新日志草稿等场景。
OpenBMB 发布 MiniCPM-Desk-Pet,一款由 MiniCPM5 驱动的本地优先(local-first)桌面宠物。该仓库主打在本地运行,强调数据与推理不依赖云端。
阿里巴巴在 GitHub 开源代码审查工具 alibaba/open-code-review,采用确定性流水线加 LLM Agent 的混合架构,支持精确到行级的审查评论。内置多语言规则集覆盖 NPE、线程安全、XSS、SQL 注入,兼容 OpenAI 与 Anthropic 接口,并称已在阿里内部规模场景下验证。
Google DeepMind 在 Project Genie 中推出 Street View grounding 能力,用户可通过地图图钉选择美国地点并叠加 Ocean World 等风格生成世界,底层技术为 Maps Imagery Grounding。
Google DeepMind 发布 Gemini 家族首个模型 Gemini Omni Flash,可将图像、音频、视频和文本组合作为输入,生成高质量视频,并支持通过自然语言多轮编辑视频、保持角色和场景一致。
推荐理由:原文介绍了 Gemini Omni Flash 的多模态输入、对话式视频编辑能力和开放范围,读者可以判断它对视频创作流程的影响。
Google 发布智能体开发平台 Google Antigravity 2.0。该平台在 Google DeepMind 官网被列为面向开发者的 agentic development platform,与 Gemini 应用、Google AI Studio 并列于产品与工具入口。
Google DeepMind 发布 Gemini for Science,包含 Google Labs 上三个实验工具:基于 Co-Scientist 的 Hypothesis Generation。
Google 扩展内容透明与验证工具:Gemini 应用的 SynthID 图像、视频和音频验证已被使用 5000 万次,该能力今日扩展至 Search,未来几周进入 Chrome。
推荐理由:原文汇总了内容溯源验证工具在 Search、Gemini、Chrome、Pixel 与 Cloud 的具体落地范围和开放伙伴,读者可据此了解可用入口。
Nous Research 在 GitHub 上线 hermes-compression-eval,一个面向 hermes-agent 的 ContextCompressor 的离线探针式评测工具。其方法论改编自 Factory 于 2025 年 12 月发布的《Evaluating Compression》。
剑桥大学 Clare Bryant 教授使用 Google Co-Scientist 研究流感等病原体跨物种传播时引发脓毒症等重症的分子开关。Co-Scientist 生成并排序了一批假说,其中优先锁定了一个她此前未关注的蛋白,并逐步将假说细化到具体氨基酸。Bryant 团队正构建含氨基酸突变的细胞系验证,原本需两到三年的实验工作有望在六个月内完成。
爱丁堡大学团队用 Google Co-Scientist 研究 MASH 肝病,系统整合肝脏生物学与药理学证据,提出将 NLRP3 炎症小体作为连接炎症与代谢的分子桥梁这一新假设,并经实验验证。该假设或为靶向联合疗法铺路,也解释了 resmetirom 为何仅对少数符合条件的患者有效。
Google DeepMind发文复盘,其AI气象模型WeatherNext帮助美国国家飓风中心(NHC)提前五天以80%置信度预测飓风Melissa将以五级强度登陆牙买加,三天前置信度升至接近100%。
推荐理由:Google DeepMind复盘了WeatherNext在飓风Melissa中的实际应用,读者可以了解AI气象模型提前五天预测快速增强的具体表现和局限。
阿里巴巴在 GitHub 新建 alibaba/ray 仓库,将 Ray 定位为 AI 计算引擎,由核心分布式运行时和一组用于加速机器学习工作负载的 AI 库组成。该仓库为 fork,用于向上游提交 PR 贡献代码。
阿里巴巴开源 FlagTree,一个支持多种 AI 芯片后端的统一编译器,用于自定义深度学习算子。该仓库为贡献用 Fork,所有改动计划提交上游 PR。
Together AI 发布完全开源的视频翻译工具 Violin,基于 Together API 提供 Web 应用、CLI 和 Agent Skill 三种形态,代码以 MIT 协议开源。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体系统,通过生成、辩论和进化假设来加速复杂科学问题研究,并将在未来几周通过 labs.google/science 向个人研究者开放。
推荐理由:原文给出多智能体架构、想法锦标赛机制和多个实验室应用结果,读者可了解它如何辅助科学假设生成与验证。
OpenAI 在 GitHub 新建 openai-developers-for-claude 仓库,推出面向 Claude Code 的 OpenAI Developers 插件。该仓库名为 openai/openai-developers-for-claude,正文仅说明这是 Claude Code 的 OpenAI Developers 插件,未披露具体功能、版本或可用性细节。
NousResearch 在 GitHub 发布 agent-governance-toolkit 开源仓库,面向自主 AI 智能体提供策略执行、零信任身份、执行沙箱和可靠性工程能力。仓库说明覆盖 10/10 OWASP Agentic Top 10。
阿里巴巴在 GitHub 上线 skill-up,一个用于 Agent Skills 评估与进化的工具。该仓库定位为对 Agent 技能进行评测并推动其迭代演进,目前公开信息仅包含这一句功能描述。
Sierra 的 Monitors 是常驻评估层,用 LLM-as-judge 审查每一段对话,追踪智能体质量与客户情绪。每个 monitor 都经过基于团队标注对话和模型一致性的严格评估循环,模型分歧会被反馈进训练与评估集,直到稳定一致。Sierra 还通过 Agent Studio 让企业用自然语言创建自定义 monitor,并走同一套评估流程。
Modem 向所有用户推出 Agent Skills,即可复用的智能体指令集,由 slug、一句触发描述和指令正文三部分组成,在 chat、Slack 和 automations 中统一生效,并与全组织共享。
browser-use 发布新仓库 terminal,一个用于在浏览器中完成任务的终端 UI。该工具以终端界面形式操作浏览器,具体功能与可用性细节尚未在仓库描述中展开。
Google DeepMind 发布 AlphaEvolve(基于 Gemini 的编码智能体)一年来的影响汇总。
推荐理由:原文系统汇总了 AlphaEvolve 一年来在科研、基础设施与商业中的落地案例,附具体数字,可作为评估此类编码智能体实用价值的参照。
阿里巴巴在 GitHub 上线 UnifiedModel,一个让 AI 智能体理解企业数据的语义层。该模型只需定义一次实体与关系,即可通过 SPL/MCP/REST 查询,并把遥测、服务与业务对象连入同一对象图。
OpenAI 在 GitHub 新建仓库 openai/openai-cli,定位为 OpenAI API 的官方 CLI。仓库目前仅有一句说明,未披露具体命令、支持模型或发布时间。
OpenAI 上周在 Codex 中发布 Auto-review,用单独的 Agent(GPT-5.4 Thinking low reasoning)在沙箱边界自动批准或拒绝操作,替代人工同步审批。
推荐理由:原文给出 Auto-review 的机制、内部部署数字和已知局限,读者可据此评估它在编码 Agent 工作流中的适用性。
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生临床监督下辅助患者照护的 AI 智能体。在 98 个真实初级保健问题的盲评中,该系统在 97 例中零关键错误,优于两种医生广泛使用的 AI 系统;在 OpenFDA RxQA 开放式用药问答上超越其他前沿模型。
推荐理由:原文给出盲评与模拟问诊的测试结果和局限,读者可以了解医疗 AI 在辅助医生与患者场景中的实际表现边界。
OpenAI 推出 OpenAI Developers 插件,帮助开发者在 ChatGPT 和 Codex 中构建 AI 应用与智能体,并提供 OpenAI API 接入与配置指引。
OpenAI 在 GitHub 新建仓库 openai-realtime-meeting-assistant,演示如何把 Realtime API 用作会议助手来管理 Kanban Board。该仓库为示例项目,展示 Realtime API 在会议场景中驱动看板任务管理的用法。
Google Research 介绍了科学家及学术合作者使用 Empirical Research Assistance(ERA)开展研究的四个方向。公共卫生方面,团队将 COVID-19 住院预测扩展到流感和 RSV,并每周实时向 CDC 相关项目提交预报,在流感与 COVID-19 公开排行榜上处于或接近榜首。
Together AI 宣布 DeepSeek-V4 Pro 上线,提供 Serverless Inference(512K 上下文)与 Dedicated 部署(完整 1M 上下文、预留容量)。
推荐理由:原文给出部署形态、定价与基准数字,读者可以据此评估在 512K 上下文上运行 DeepSeek-V4 Pro 的实际成本与路径。
阿里巴巴在 GitHub 上线 AILens,为 AI 提供全栈可观测性,首批支持端到端 RL 后训练,后续将扩展到 Agent 与推理引擎监控。
NVIDIA Nemotron 3 Nano Omni 现已在 Together AI 平台可用,Together AI 提供首日(Day 0)接入与 Dedicated Inference 部署。