#Agent
#Agent
今日 14 条
MiniMax (official)@MiniMax_AIAI 评分3535Together AI 研究与产品博客(RSS)AI 评分3636 一家全球金融科技公司如何用 Dedicated Model Inference 支撑编码智能体流量
一家全球金融科技公司把编码智能体工作负载迁到 Together 的 Dedicated Model Inference,运行 GLM-5.2 并采用多副本 B200、256K 上下文配置。
Claude Code:GitHub Releases(RSS)AI 评分3939 Claude Code v2.1.275 发布
Claude Code 发布 v2.1.275,新增登录账号显示、ctrl+enter 立即发送排队消息,以及将 claude.ai 账号启用的技能和插件同步到终端会话。该版本还修复了恢复会话时提示缓存失效、全屏模式滚动卡顿、插件市场更新误删本地副本等问题,并改进 --system-prompt 中 __SYSTEM_PROMPT_DYNAMIC_BOUNDARY__ 行的提示缓存。
Josh Woodward@joshwoodwardAI 评分5353引用Google Labs@GoogleLabsCC the entire fam 🤝! Today, we’re announcing the new CC – an AI agent built for families to spend less time on logistics and more time together. You can now: 👤 Add up to 5 members to your CC agent ☀️ Start mornings aligned with a shared "Your Day Ahead" brief email 🗓️ Autosync schedules & to-dos with a shared Google Calendar and Tasks 💬 Coordinate in Google Chat with CC to offload relevant tasks (ie., crafting weekly meal plans, school supply shopping lists, etc) 📝 Delegate paperwork (ie., permission slips, forms, and more) for CC to complete under your direction 📌 Keep tabs on the details – CC remembers what applies to everyone (ie., family grocery lists, favorite restaurants) versus what applies to one person (ie., dietary restrictions, local timezones) Ready to keep everybody on the same page? Join the waitlist or upgrade your existing CC (US only, 18+): http://labs.google/cc
Nous Research:GitHub 新仓库AI 评分2929 Nous Research 发布 Hermes 独立记忆插件 hermes-plugin-supermemory
Nous Research 在 GitHub 发布 Hermes 独立记忆提供方插件 hermes-plugin-supermemory,接入 Supermemory 语义长期记忆。该插件支持 profile recall、语义搜索、显式记忆工具以及按轮次的记忆能力。
Nous Research:GitHub 新仓库AI 评分4444 Nous Research 发布 Hermes 记忆插件 hermes-plugin-honcho
Nous Research 在 GitHub 发布独立 Hermes 记忆提供方插件 hermes-plugin-honcho,接入 Honcho 的 AI 原生记忆能力。该插件支持跨会话用户建模、辩证式问答、语义搜索与持久化上下文。
Nous Research:GitHub 新仓库AI 评分4545 Nous Research 发布 Hermes 全息记忆插件 hermes-plugin-holographic
Nous Research 在 GitHub 发布独立 Hermes 记忆提供方插件 hermes-plugin-holographic,采用全息记忆方案,基于本地 SQLite 事实存储,支持 FTS5 搜索、信任评分与 HRR 组合式检索。
Nous Research:GitHub 新仓库AI 评分4040 Nous Research 发布 Hermes 记忆插件 hermes-plugin-hindsight
Nous Research 在 GitHub 上线独立 Hermes 记忆提供方插件 hermes-plugin-hindsight,为 Hermes 提供长期记忆能力。该插件支持知识图谱、实体消解与多策略检索。
Nous Research:GitHub 新仓库AI 评分3333 Nous Research 发布 Hermes 记忆插件 hermes-plugin-byterover
Nous Research 在 GitHub 发布独立 Hermes 记忆提供方插件 hermes-plugin-byterover,接入 ByteRover 持久化知识树。该插件通过 brv CLI 实现分层检索,为 Hermes 提供外部记忆能力。
Sierra:Blog(RSS)AI 评分4040 Sierra 通过 AIUC-1 认证,AI 智能体安全测试覆盖对抗场景
Sierra 宣布通过 AIUC-1 认证,该认证经 Schellman 独立审计并由 AIUC 完成大量测试,专门针对 AI 智能体的实际行为,包括操纵尝试、受保护信息访问和越权操作等对抗场景。
Microsoft:Official Blog(RSS)AI 评分5252 Microsoft 分享自身 AI 转型的五条经验与 Frontier Playbook
Microsoft 高管 Kathleen Hogan 总结公司作为 Customer Zero 的 AI 转型经验,提出五条核心经验:从业务结果出发、重构完整工作流、以员工为中心、用 AI 扩展人的能力、建立人机共同学习循环,并发布 Frontier Playbook。
jietang@jietang精选AI 评分6666唐杰发文复盘,GLM-5.3-Flash 从首次在国内加速器上运行到承接全部生产流量只用两周,端到端吞吐达 3.2 倍,大量工作由 GLM-5.3 驱动的 Infra Agent 完成。
引用Z.ai@Zai_orgWe’re sharing how GLM-5.3 helped build and optimize the inference infrastructure serving GLM-5.3-Flash. The system went from its first successful run to production readiness in less than two weeks, with end-to-end throughput tripling relative to the initial baseline. The key was dense feedback: local correctness tests, execution traces, microbenchmarks, and end-to-end measurements that enabled targeted hypothesis testing rather than reliance on aggregate performance metrics alone. https://z.ai/blog/glm-built-its-inference-infrastructure
推荐理由:作者复盘了 GLM-5.3 智能体优化推理基础设施的两周过程,提出了可迁移的分层密集反馈方法与工程师角色转变的判断。
GitHub Blog精选AI 评分8585 GitHub Copilot 用 Copilot 把运行时迁移到 Rust:80 万行代码、128 个 PR
GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript/Node.js 完全重写为超过 80 万行生产级 Rust,AI 智能体编写了大部分代码,跨 128 个 PR 增量合入 main,性能提升数个数量级,主要由一名开发者几个月内完成。
推荐理由:GitHub Copilot 运行时迁移 Rust 的完整复盘,给出智能体并行协作、提示缓存与评审流程的可迁移工程方法。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分4141 如何用 AI 智能体为仿真准备 3D 场景
NVIDIA 展示了一套智能体 AI 工作流,用于为物理 AI 系统准备和验证数字孪生。智能体可检查 3D 场景、在 OpenUSD 中编写仿真相关数据、添加物理属性、渲染预检视图,并对照 SimReady 要求验证结果。该流程覆盖从 Blender 场景到面向 NVIDIA 的仿真就绪 OpenUSD 交付。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分3030 TensorRT Edge-LLM 在 Jetson AGX Thor 上以 6.4 倍速度完成 MLPerf Edge Agentic Benchmark
NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该方案面向从云端数据中心迁移至车辆、机器人等边缘设备的 AI 智能体,针对其多步骤工具调用、结果评估与长对话推理带来的边缘推理新需求,实现快速 token 生成。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分3939 OpenAI 用 AI 重塑广告:Sponsored Agents 与 HubSpot、Shopify 集成
OpenAI 推出 AI 驱动的广告新体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分1818 OpenAI 如何将 AI 使用情况与业务价值挂钩
OpenAI 介绍如何通过 ChatGPT Work 和 Codex 的分析功能,帮助团队了解 AI 使用量与支出、识别培训需求,并将采用情况与业务成果关联。
Mistral AI:News(网页)AI 评分4242 Mistral 与 Mozilla 合作,为 Firefox 浏览器带来开放、私密的多语言 AI
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
Apple Machine Learning Research(RSS)AI 评分4949 面向 Agentic LLM 系统的共享选择性持久记忆架构
研究者提出共享选择性持久记忆架构,为多轮工具调用的 Agentic LLM 系统保留任务规格、数据 schema、工具配置和输出约束四类可复用上下文,并丢弃会话专属推理轨迹。
Apple Machine Learning Research(RSS)AI 评分3838 Glyph:面向企业数据目录列描述与敏感本体标注的多策略智能体系统
Apple 研究团队提出 Glyph,一个将列描述生成与列类型标注建模为有状态图编排的多智能体 LLM 生产系统。其 Descriptor 通过推理-行动工具循环从企业 GitHub 按需检索管道源码来支撑生成,Tagger 并行运行描述、业务线正则与元数据三种策略,并用 RRF 融合排序结果,从 275 叶节点的数据分类本体中打标。
NVIDIA Blog(RSS)AI 评分4949 黄仁勋在 Dreamforce:Salesforce 首个 CRM 推理模型 Koa 基于 NVIDIA Nemotron 3 Super 构建
Salesforce 在 Dreamforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练而成,训练语料覆盖 14+ 行业的合成企业场景。
Google DeepMind:Blog(RSS)精选AI 评分8282 Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型,前者面向规模化与成本效率,后者面向高复杂度任务与多步推理。
推荐理由:官方给出两款语音模型的基准成绩与开放渠道,可据此判断实时语音智能体的能力与成本取舍。
Hugging Face:Blog(RSS)精选AI 评分6262 Hugging Face 发布 ALTK-Evolve 一致性指南与 Consistency Analyzer,将智能体一致性差距减半
IBM Research 与 Hugging Face 在 ALTK-Evolve 中推出一致性指南和 Consistency Analyzer,用于诊断和改善智能体重复运行的不稳定性。
推荐理由:原文给出一致性差距的量化诊断方法与开源实现,读者可据此评估和改进智能体在重复运行下的可靠性。
MiniMax Design (H3)@Hailuo_AIAI 评分3737一句简述 ➕ 一块画布 🟰 一整支制作团队,尽在 #MiniMaxDesign。
引用Stefan 3D AI@Stefan_3D_AII gave Astra one brief and it delivered the whole scene in Blender, camera direction included. All of it ran inside MiniMax Design. Astra sits there as the agent and talks to Blender over an official connector, so everything syncs straight onto the canvas. The final video is MiniMax H3, from the same canvas. #MiniMaxdesign - https://design.minimax.io/
Nous Research:GitHub 新仓库AI 评分3737 Nous Research 发布 Hermes Agent 记忆 Wiki 插件
Nous Research 在 GitHub 上线 hermes-memory-wiki,为 Hermes Agent 提供可浏览的会话历史 Wiki 与持久记忆审计面板。该插件以 dashboard plugin 形式接入,用于查看会话记录并审计持久记忆内容。
Apple:Newsroom(RSS)精选AI 评分8282 Apple 发布 Siri AI 与新一代 Apple Intelligence 功能
Apple 于 2026 年 9 月 14 日发布新一代 Apple Intelligence,推出全新版本的 Siri AI,具备个人上下文理解、屏幕感知、更广泛的系统级应用操作,并在 iPhone 相机、iPad 截图、Mac 快捷键和 Apple Vision Pro 中集成 Visual Intelligence。
推荐理由:官方完整列出了 Siri AI 的具体能力、设备要求和区域限制,读者可以据此核对自己设备上的功能可用范围。
SiliconFlow@SiliconFlowAIAI 评分5757
SenseTime@SenseTime_AIAI 评分5555商汤介绍开源智能体办公技能套件 SenseNova Skills,将 Deep Research、数据分析、PPT 生成与信息图生成整合为一体化流程,可把原始数据处理成可编辑的 .pptx 文件。
SenseTime@SenseTime_AIAI 评分2323
Nous Research:GitHub 新仓库AI 评分3636 Nous Research 发布 Hermes Agent 插件 hermes-plugin-snyk
Nous Research 在 GitHub 发布 Hermes Agent 插件 hermes-plugin-snyk,通过 Snyk 官方 MCP server 实现代码、依赖、容器与 IaC 扫描,并内置 snyk-security-scan 技能(Agent Plugins v1)。
Nous Research:GitHub 新仓库AI 评分3333 Nous Research 发布 Hermes Agent 插件 hermes-plugin-touchdesigner,可驱动 TouchDesigner
Nous Research 在 GitHub 发布 Hermes Agent 插件 hermes-plugin-touchdesigner,通过 twozero MCP server 驱动 TouchDesigner,并内置 touchdesigner-mcp 技能,采用 Agent Plugins v1 规范。
GitHub BlogAI 评分3434 GitHub 如何用 Copilot 把营销活动运营变成代码
GitHub 日本和韩国营销负责人把活动运营流程交给 GitHub Copilot,从单个 GitHub Issue 出发自动完成落地页复制、UTM 链接生成、报名名单清洗和会后报告。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2828 Cognition 借助 GPT-6 Astra 让 Devin 自测代码
Cognition 用 GPT-6 Astra 提升 Devin 测试软件并证明其可用的能力,目标是让工程师少审代码、多交付。该能力聚焦于 Devin 对自身工作的验证环节。
Google ResearchAI 评分4141 Google Research 提出 ToolGrad:用文本“梯度”高效生成工具调用数据集
Google Research 提出 ToolGrad,一种“先答案后问题”的工具调用数据生成范式:先迭代构建可验证的 API 调用链,再反推用户提示词,替代 ToolBench、ToolACE 等基于 DFS 试错的低效方案。
GitHub BlogAI 评分3030 GitHub Copilot 应用新手指南:使用 diff、终端与浏览器面板
GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让开发者无需在编辑器、终端和浏览器之间切换即可完成 AI 编码闭环。diff 面板以绿色标注新增、红色标注删除,支持接受改动、留言或让 Copilot 继续修改;终端面板可直接运行项目命令并支持多窗口;浏览器面板可用 Pick & Polish 工具选中元素并让智能体调整。
a16z:News(RSS)AI 评分3232 a16z:雇主开始寻找新型健康保险计划,AI 正在降低建计划门槛
a16z 发文指出,随着保费每年上涨 10% 以上,多数雇主正开始寻找替代方案,或转向低成本健康计划,或彻底放弃传统健康保险。这一规模达 1 万亿美元、覆盖 1.5 亿以上美国人的雇主医保市场,正因 AI 降低建计划与运营的固定成本门槛而出现代际替换机会,催生一批新型替代健康计划(AHP)、挑战者 PBM 和现代化基础设施平台。
Sierra:Blog(RSS)AI 评分4242 Sierra 推出下一代多模态智能体:随对话形态变化的界面
Sierra 发布多模态智能体,将语音、文本和可视化整合进同一段对话,并自动判断何时切换模式,用户无需重来或重复表述。该智能体一次构建即可部署到所有渠道,视觉组件同样通用;其 MCP UI 集成支持把产品卡片、对比表格、日历和表单直接嵌入对话,组件由企业自行设计和托管,更新后自动同步,无需重新部署或为各平台维护不同版本。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分2929 全栈 NIM 优化如何在 Nemotron 3 Ultra 上支撑 2.5 倍并发用户
NVIDIA 通过全栈 NIM 优化,在 Nemotron 3 Ultra 上实现 2.5 倍并发用户量。该优化针对生产环境部署大语言模型时,在现有 GPU 基础设施上提升并发服务能力并保持交互响应速度的需求,对提示词长、上下文跨步骤复用的智能体 AI 工作负载尤为关键。
Logan Kilpatrick@OfficialLoganKAI 评分3636
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分5959 ChatGPT Work 推出 Data agent,用自然语言连接公司数据并构建仪表盘
OpenAI 在 ChatGPT Work 中推出 Data agent,支持连接公司数据、发掘洞察,并用自然语言让 AI 构建交互式仪表盘。