Claude Code v2.1.283 发布
Claude Code 发布 v2.1.283,新增 x-claude-code-prompt-id 网关提示头,可通过 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 开启,便于 LLM 网关按用户提示词归组请求。
Claude Code 发布 v2.1.283,新增 x-claude-code-prompt-id 网关提示头,可通过 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 开启,便于 LLM 网关按用户提示词归组请求。
MIT 本科生参与 PKG 中心 2026 年 Code.Tulsa 项目,在俄克拉荷马州塔尔萨为 Muscogee 和 Cherokee 部落及当地非营利组织完成 AI、数据科学等技术实习。
Proaction 使用 Codex 后销售转化率提升 60%,每月节省 40–60 小时工程时间和 25–33 小时创始人时间。其联合创始人 Colin Knudsen 每月用 Codex 在 30–45 分钟内构建 4–6 个定制交互演示,并借助 Granola、Gmail、Slack、Linear、GitHub、HubSpot 等插件统一处理日常工作。
GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义界面,用户只需在 agent 会话中输入 /create-canvas 技能并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码或手动设计。
AWS 提出在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 模型强化学习训练的架构,吞吐量提升 40%。该方案针对 rollout 生成与策略训练并行的异步 RL 负载,用 DeepEP 优化专家并行(EP)在 EFA 上的 all-to-all 通信,缓解跨节点带宽瓶颈。适用于 RLHF、PPO 和 GRPO 等大规模 RL 训练流程。
在 Amazon SageMaker HyperPod 上使用开源 RL 框架 SkyRL,通过 GRPO 对 Qwen3-VL-8B 视觉语言模型进行多轮强化学习后训练,在固定 64 个迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
NarrateAI 在 Amazon Bedrock 上通过五项技术实现约 99% 的数值准确率并实时流式返回结果,服务超过 4000 名 AWS 高管。这五项技术分别是自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证,其中约 90% 的查询走单次快速路径,仅约 10% 的复杂查询进入并行批处理路径。
AWS 博客演示如何通过 SageMaker JumpStart 将 Qwen3-TTS-12Hz-1.7B-Base 部署到实时推理端点,用几秒参考音频和转录文本克隆说话人音色,无需重训模型。
S&P Global Energy 在 Databricks 博客详解如何让覆盖 LNG、Chemicals、Crude Oil、Refined Products、Gas & Power 等的结构化数据资产可供 AI 智能体对话。
Datacor 将 Amazon Quick Sight 嵌入其 TrackAbout 解决方案,为工业气体与焊接分销商提供交互式仪表盘和自然语言查询的自助式租赁分析。
Amazon SageMaker HyperPod 搭配 Qumulo 的 Cloud Native Qumulo(CNQ)与 Cloud Data Fabric(CDF),可让训练集群直接读取另一 AWS Region 或本地数据中心的数据集,无需复制数据或修改代码。
a16z 正在推出 Cosign,用于呈现硅谷靠彼此背书识别人才的关系网络。文章认为,早期信念通过关注、转发、引荐、天使投资等"co-sign"行为变成公开信号,让一个人的地位在社交图谱上被实时定价。相比"非共识","足够早"才是更关键的下注优势。
Modem 上线 ChatGPT 插件目录,用户登录授权后即可在 ChatGPT 对话中通过 @Modem 调用客户反馈数据,无需额外配置。插件支持查找近 30 天客户最常请求的修复、合并重复项并统计受影响客户数,还可将常用查询保存为技能并定时运行。
微软宣布重塑 Microsoft Copilot,推出三大新能力:Home 作为统一入口整合 Chat 和 Cowork 并内置 Office;Code 让非开发者用自然语言构建应用,与 GitHub Copilot 同源技术并在沙箱中运行;Autopilot(原名 Scout)是可在租户内持续自主工作的智能体。
上海人工智能实验室推出 InternLM/Intern-Decision,一个快速多模态决策模型。该模型以多模态决策为核心定位,强调快速响应能力,具体参数规模、benchmark 分数与开放方式尚未在现有信息中披露。
Sakana AI welcomes Jürgen Schmidhuber as Chief Scientific Advisor. https://sakana.ai/schmidhuber/ Sakana AI is incredibly proud to announce that Jürgen Schmidhuber, universally recognized as the father of modern AI, is officially joining Sakana AI as Chief Scientific Advisor. For nearly four decades, Jürgen has explored how machines can learn to learn. His foundational work in the 1990s drove core advancements in deep learning and established early frameworks for world models. Crucially, his pioneering innovations in meta-learning opened the very path toward recursive self-improvement. These ideas have already shaped our own research, from the Darwin Gödel Machine to The AI Scientist. Now Jürgen will help guide our newly formed RSI Lab, whose objective is to trigger a compounding cycle of scientific discovery aimed at improving machine intelligence. We are assembling a critical mass of world-class experts in Tokyo to make this a reality. Welcome, @SchmidhuberAI !
MIT McGovern 研究所的 Satra Ghosh 和 Daniel Low 团队开发了一个语言处理工具,用包含 49 个自杀风险因素、每个因素约 60 个词或短语的词表分析文本,准确预测危机对话中的自杀风险,论文发表于 Journal of Psychopathology and Clinical Science。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
很多人想知道如何用我们新的编辑模型来实现一致的角色等等——所以我们为你们做了一个视频 <3
Google Research 发布 AI video co-director,一个构建在 Gemini 和 Veo 之上的多智能体编排框架,用于生成连贯的多镜头长视频,并原生继承 SynthID 水印等安全机制。
推荐理由:Google 把长视频生成拆成四个可组合的智能体框架,并给出三套自建基准与量化结果,便于对照现有方案。
Midjourney 在 alpha.midjourney.com 界面测试快速模型,Styles 侧边栏新增风格预览功能,开启 "Live previews" 可查看提示词在已点赞和精选风格下的效果,点击缩略图即可用该风格生成。
Claude Code v2.1.282 新增 maxProseWidth 设置,可限制宽终端中 Claude 正文宽度而表格与代码块保持全宽,并新增启动提示及 /status、claude doctor 中列出被忽略或关闭遥测的变量。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并分诊崩溃。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可了解其分层设计与安全边界。
Chrome 将 Gemini 的媒体理解能力在桌面端扩展到播客及 YouTube 以外的视频,播放后即可提取要点、定位信息或解释难点。Gemini 还能基于标签页内容生成互动测验,已在美印桌面端以英文推出,未来数月扩展至更多地区和移动端。此外 Chrome 新增跨设备发送标签页时保留滚动位置和未填完表单,并支持分屏视图、标签组、沉浸式阅读模式和朗读功能。
Google 在 Google Health 应用中推出 Health Guardian 功能,Pixel Watch 用户可设置血压趋势、胰岛素抵抗趋势和睡眠呼吸质量指标,本周开始启用,首批趋势报告将于 10 月初送达。
Google Photos 上线 5 项更新,其中 Photos in Gemini Spark 支持用一句提示词挑选、提亮并分享家庭合照,面向美国符合条件的 Google AI Pro 和 Ultra 订阅用户。
Databricks 展示了如何在 SQL 中直接运行开源决策模型 SemIf-OpenJev,通过 ai_query 对受治理数据做结构化分类。该流程借助 AI Runtime 提供 Serverless GPU 算力,自动下载模型、用 Express Deployments 注册并创建 GPU Model Serving 端点,三步即可从 Notebook 到端点。
Databricks 发布 Unity Gateway CLI,让管理员集中配置编码智能体的默认模型、MCP 服务器、技能、Smart Routing 和支出策略,开发者用 `ug claude`、`ug codex` 等命令即可启动已批准的智能体。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,把近实时视频生成与语音对话模型结合,让对话 AI 具备动态视觉形象,支持精准唇形同步、自然表情和流畅轮次切换。
推荐理由:官方披露了实时视频与语音耦合的对话能力、异步工具调用和 97 种语言支持,可据此判断企业级数字人交互的落地边界。
AWS 发布 WhisperX Deep Learning Container(DLC),在 OpenAI Whisper 基础上加入 wav2vec2 强制对齐的逐词时间戳和说话人分离,可部署到 Amazon SageMaker AI 实时或异步端点,无需自建镜像。
Google 为 Demand Gen 推出九月更新,在 YouTube 广告中上线 Business Agent,观众可在视频广告旁与对话式 AI 互动,通过商品 feed 即时获取产品或品牌信息。
推出 Agora-2,我们的下一代多智能体世界模型。 Agora-2 支持最多 20 个人类和智能体在同一共享环境中互动,全部实时模拟。 我们的多人研究预览版现已开放体验!