Claude Code v2.1.282 发布
Claude Code v2.1.282 新增 maxProseWidth 设置,可限制宽终端中 Claude 正文宽度而表格与代码块保持全宽,并新增启动提示及 /status、claude doctor 中列出被忽略或关闭遥测的变量。
Claude Code v2.1.282 新增 maxProseWidth 设置,可限制宽终端中 Claude 正文宽度而表格与代码块保持全宽,并新增启动提示及 /status、claude doctor 中列出被忽略或关闭遥测的变量。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并分诊崩溃。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可了解其分层设计与安全边界。
Databricks 发布 Unity Gateway CLI,让管理员集中配置编码智能体的默认模型、MCP 服务器、技能、Smart Routing 和支出策略,开发者用 `ug claude`、`ug codex` 等命令即可启动已批准的智能体。
Google 为 Demand Gen 推出九月更新,在 YouTube 广告中上线 Business Agent,观众可在视频广告旁与对话式 AI 互动,通过商品 feed 即时获取产品或品牌信息。
推出 Agora-2,我们的下一代多智能体世界模型。 Agora-2 支持最多 20 个人类和智能体在同一共享环境中互动,全部实时模拟。 我们的多人研究预览版现已开放体验!
Google 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力原生结合,让企业智能体在对话中"能听、能看、能说",并具备精准唇形同步与自然表情。
很高兴介绍 X-Planner:面向具身智能的事件结构化任务规划——一个将语义事件作为规划单元的前端,通过 Staircase Decoding 暴露离散+隐式接口,在真实机器人上超越基线。
To address long-horizon robotic manipulation tasks, we propose X-Planner, an embodied long-horizon task planner: It decomposes high-level natural language instructions into event-level subtasks, and can also output continuous implicit Chain-of-Thought (CoT). It directly interfaces with downstream VLA or WAM models to operate robots. GitHub: https://github.com/X-Square-Robot/Xplanner Checkpoint: https://huggingface.co/x-square-robot/X-Planner-9B-0916 Benchmark: https://huggingface.co/datasets/x-square-robot/xplanner-benchmark
一位工程师在 Databricks 上构建了基于智能体的安全审查层,用 7 个各司其职的智能体承接可重复的审查工作,把人工判断留给高风险和模糊决策。
Claude Code 发布 v2.1.281,为 Claude apps gateway 新增 Claude Desktop 新密钥的桌面策略块支持、Bedrock 上游的 assume_role 与 Amazon Bedrock guardrail 配置,并支持在 settings.json 中用 "attribution": false 隐藏提交与 PR 署名。
Android Enterprise 公布 6 项更新,涵盖 Gemini 多步骤跨应用自动化、工作资料隔离与 IT 集中管控,以及 XREAL Aura 有线眼镜等 XR 设备统一管理。
a16z 推出 Ops Engineering Fellowship,面向用 AI 重塑组织运作方式的跨职能建设者,为期六周,2026 年 10 月启动。该项目提供旧金山线下晚宴系列,参与者包括 Ramp、Stripe、Decagon 等公司的内部 AI 负责人。a16z 认为运营已成为工程问题,招募对象是构建或部署跨职能 AI 智能体、把 AI 从个人工具变成组织基础设施的人。
Google DeepMind 公布 Private AI Compute 架构更新,将持久化的服务端记忆引入该平台,使 AI 助手能跨设备保留上下文。数据被密封在加密存储中,解锁密钥仅保存在用户个人设备上,模型访问时通过端到端加密通道连接云端安全隔离区,在隔离内存中临时解密、保存新上下文后立即重新加密。
推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端记忆如何在设备持钥前提下实现。
MIT 任命计算机科学家、Two Sigma 联合创始人 David Siegel 为 2026-27 学年 Innovation Fellow,他将与 MIT Schwarzman College of Computing 合作探索 AI 如何加速科学发现。
invideo 使用 GPT-6 Astra 后,调色与色彩校正任务成功率提升约 3 倍,并在一天内创建约 50 个自定义特效。该模型能以更少推理步骤和输出 token 完成复杂剪辑规划,并实现帧级精度的编辑规划。
Ringg 基于 GPT-5.6 构建的语音与聊天 AI 智能体每月处理超 700 万通来电,最高可解决 65% 的客户请求,客户平均 CSAT 为 4.8。将部分实时负载从 GPT-4.1 迁移至 GPT-5.6 后,模型成本降低约 90%。
NVIDIA 于 9 月 22-23 日在新加坡举办 AI Day,与合作伙伴展示东南亚地区的 AI 进展。新加坡 HTX 正研究使用 NVIDIA Nemotron 3 Super 和 Nemotron 3 Nano Omni 模型推进公共安全 AI,马来西亚 YTL AI Labs、越南 Viettel AI 等也在微调 Nemotron 模型。
Gary Marcus 撰文对比 Meta 新智能体 Muse 与 Facebook 2015 年的 Project M,指出两者都瞄准餐厅预订、戏票等任务。Project M 因运行成本高只开放给约 1 万用户,后被曝幕后有人工代答,2018 年 1 月被取消,AI 实际处理的请求不超过 30%;Marcus 认为 Zuckerberg 正在重复当年的错误,并质疑其对隐私的态度。
Sierra 发布博客阐述其 AI 智能体平台如何实现全流程透明:用 Ghostwriter 以自然语言构建智能体,并在 Agent Studio 中查看和编辑每一次旅程、动作、策略与 persona。
Gagan Biyani 宣布推出 The Horowitz Andreessen Academy,这是位于旧金山、面向高中毕业生及大学低年级学生的选拔制学校,以 Pursuits、短期 Courses 和企业 Co-Ops 为核心,无传统考试和作业。
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,为基于 ROS 的机器人开发引入智能体工作流和新的平台支持。
推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出从 Jetson Orin 到 Thor 的部署路径,可据此判断机器人开发方式的变化。
Parallel 借助 GPT‑6 Astra 让智能体研究并综合劳动力市场数据,耗时和成本均降至此前模型的一半。
Meshy 🤝 chrona 让你的 3D 创意尽情释放 🤩
What if Tech Week wasn’t a calendar, but a city you could actually enter and play? We made a SF TECH WEEK CITY — rebuilding San Francisco as a 3D world with Tech Week events placed at their real venues. RSVP activity, trending events, and busy areas become part of the world itself. The birds flying above the city represent real community members, so you can see where people are heading and explore alongside them. Built with AI coding and published on Chrona. A small experiment in turning real-world data into a place worth entering. @MeshyAI @ChronaWorld #MeshyxChrona #TechWeek
NVIDIA 提出 AI 智能体评估需从单次工具调用打分转向整项任务完成度打分,核心是看智能体能否在真实环境中连续执行数十次工具调用并在某步失败后恢复。仅评估模型回答是否"听起来对",几乎无法反映工作是否真正完成。
NVIDIA发文提出AI安全是工程问题,需要有明确安全要求、可执行控制、责任人和防护有效证据。文章按Agent技术栈逐层展开安全责任,强调运行环境需独立于Agent推理强制执行文件。
小米 MiMo 在 GitHub 新建仓库 uni-agent,这是一个用于训练长程(long-horizon)智能体的框架。目前公开信息仅包含框架定位,未披露模型规模、训练数据或评测结果。
小米 MiMo 在 GitHub 开源 mimoagent,一个仅约 100 行代码的 AI 智能体,可解决 GitHub issue 或在命令行中辅助用户。项目主打极简设计,无需庞大配置和大型 monorepo,并在 SWE-bench Verified 上取得超过 74% 的分数。仓库地址:https://github.com/XiaomiMiMo/mimoagent
V7 使用 GPT-5.6 Luna 将成本削减 78%,同时提升准确率。该方案利用 GPT-5.6 把分散的公司文件转化为智能体可用的上下文,以完成复杂的、带来源链接的工作。
Nous Research 在 GitHub 发布 Hermes Agent 模型提供方插件 hermes-plugin-claude-subscription-directsdk,可通过官方 Claude Code CLI 使用 Claude Pro/Max 订阅,目前为实验性功能。
Claude Code v2.1.277 新增 AGENTS.md 支持:项目无 CLAUDE.md 时会改读 AGENTS.md,可在 /config 的 "Project instructions" 中修改(Bedrock、Vertex、Foundry 暂不支持)。
Gary Marcus 认为,近期真正值得担忧的不是失控的超级智能,而是失控的智能体 AI 大规模发动互联网攻击。他援引《华尔街日报》评论版 Brian Gross 的文章称,主流媒体中少有机构梳理这一整体图景,并表示完全认同该文观点。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,MCP 提供工具与数据的标准接入,Skills 封装团队流程与最佳实践,二者可组合使用;RAG 并未消亡,检索能为模型提供训练数据之外的信息,减少 token 消耗并让回答更有依据。