GPT-5.6 Sol 如何助力运行量子计算实验
MIT 研究人员使用 GPT-5.6 Sol 配合 Codex 自主运行量子计算实验、分析结果并校准量子比特。该案例展示了 GPT-5.6 Sol 在量子计算实验流程中的自主执行能力。
MIT 研究人员使用 GPT-5.6 Sol 配合 Codex 自主运行量子计算实验、分析结果并校准量子比特。该案例展示了 GPT-5.6 Sol 在量子计算实验流程中的自主执行能力。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部约 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上。
推荐理由:AlphaGenome Atlas 把 90 亿个单核苷酸变异的预测结果做成可检索资源,读者可了解其数据规模与在罕见病研究中的验证案例。
2026 年 9 月,NVIDIA 宣布投入 Rust 原生 GPU 编程,推出 CUDA Rust,提供两条编写 GPU kernel 的路线。CUDA C++ 和 CUDA Python 仍是成熟的企业级工具链,NVIDIA 将持续把 CUDA Rust 发展和成熟至 2027 年及以后,以应对涵盖推理引擎、服务基础设施、驱动和 Agent runtime 的 AI 系统层需求。
OpenAI 发布 ChatGPT Images 2.5,可将用户的想法、草图和参考照片转化为更个性化、更精致且更贴近创意的图像。材料为官方摘要,未提供更多细节。
vLLM 推出 TT Plugin,通过 out-of-tree 平台插件机制将 Tenstorrent 加速器接入 vLLM,安装后只要 ttnn 可导入即自动注册为 vLLM 平台,OpenAI 兼容 API 与请求格式保持不变。
GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排提供前沿级智能,所有 GitHub Copilot 计划用户可通过 Copilot CLI 的 /experimental 使用。
推荐理由:官方详解了 HydraFusion 三种执行模式与基准成本质量数据,读者可据此判断多模型编排是否值得在 Copilot CLI 中试用。
GLOBAL BUILD is live 🌍🔥 GLM-5.3-Flash, FREE in ZCode. 10 hours a day. Sep 3 – 18. Who gets it 👑 Coding Plan members — free every day, all 15 days. Our VIPs go first. 🥚 New users — 100M free tokens on sign-up. One-time, valid until the window closes When it opens 🇺🇸 8 AM PT · 11 AM ET 🇬🇧 4 PM London 🇨🇳 11 PM Beijing How to claim 1️⃣ Open ZCode → tap the card in the bottom-left corner 👀 2️⃣ Not there? Restart the app 😏 http://zcode.z.ai
Midjourney 向 alpha.midjourney.com 推送大规模更新,最大变化是新的 v8.2 编辑模型上线,编辑器直接内置于 lightbox,可用自然语言指令编辑、附加最多 4 张参考图并集中查看本次会话的编辑。
NVIDIA 推出 PAIR 虚拟推理路由器,可将本地网络中的可用算力扩展给 AI 智能体使用。该方案面向多智能体协作场景:主智能体把复杂任务拆解后分派给专用子智能体,用户也会同时运行多个智能体会话。这种广度优先的方式可提升任务完成速度。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等 coding agent 提供基于本机已有会话日志的持久记忆层。
推荐理由:官方介绍 funes 如何把本机已有 agent 会话变成可检索的本地记忆,给出安装方式、跨 agent 共享和成本对比。
LongCat-2.0 is now free in Command Code. 1.6T params. 1M context. 48B activate. Available on all plans to all subscribers. npm i -g command-code 🐐
Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴提供受限访问,首批开放 Gemini 3.8 Flash Cyber 与 CodeMender 组合,用于自主发现、验证并修复漏洞。
推荐理由:原文给出受限访问计划的能力组合与准入对象,读者可据此判断前沿模型在漏洞修复环节的落地方式。
Google DeepMind 推出 agentic video understanding,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite,通过智能体循环动态调用原生视频工具按需检索画面、音频和字幕,而非固定帧率静态处理。
推荐理由:原文给出了具体降本增效数字、适用模型和接入方式,开发者可据此评估是否切换视频分析流程。
不止是双臂。 具身 AI 的起点。 LEMO by Galaxea —— 一个平台,开箱即用,即刻开始构建。 🦾 让创造更快发生。
Hugging Face WebAI 团队发布 @huggingface/kernels 库和 207 个 Apache-2.0 许可的 WebGPU 内核,每个内核以独立版本化仓库形式发布在 Hub 上,包含 manifest、正确性测试、基准案例和 WGSL 着色器模板。
NVIDIA 发布指南,介绍如何在 Claude Science 中运行 BioNeMo NIM 微服务完成蛋白质结构预测。该方案面向可读取论文、提出假设并调用模型的 AI 科学家,用于判断后续实验优先级。正文指出,科研比软件工程更依赖反复评估证据与修正假设,编码智能体已在生产代码中验证价值。
NVIDIA 介绍用 Omniverse NuRec 解决同一套感知软件换装到 SUV、轿车等不同车型后传感器布局、标定、视场与遮挡变化导致感知结果改变的问题。原文未披露具体版本号、参数规模或性能数字。
We have a huge news to share today! Today we are unveiling the first truly accessible RL robot - welcome Microduck A 25 cm tiny open-source biped with 15 actuators and packed with sensors (camera, speaker, LiDAR, NFC, bluetooth, wifi, etc) that you train yourself with reinforcement learning. It's also playable out of the box with more than half a dozen fun and playful pre-trained policies to have it walk, sit, crouch, roller-skate, pick up objects with its articulated beak, and recover on its own. And all for less than $400. See all the details, play with the simulator and order it at: https://pollen-robotics.com/microduck/ (video with sound on 🔊)
Nous Research 推出 Hermes Agent 的 BackSearch 插件,可在冻结的新闻存档上做时间点(point-in-time)网页搜索与抓取。该插件归属 General Reasoning 方向,仓库名为 NousResearch/hermes-plugin-backsearch。
Midjourney 更新了 V8.2 编辑模型,图像质量得到提升。官方建议过去 24 小时内遇到问题的用户重新尝试,并继续反馈意见。更多更新即将推出。
我们更新了 V8.2 编辑模型,图像质量更好了。如果你在过去 24 小时内遇到任何问题,请再试一次,并继续给我们反馈。谢谢!更多更新即将到来。
NVIDIA TensorRT Model Connect 提供开源参考实现集合,让开发者用两条命令把开源模型从 checkpoint 直接跑成 TensorRT 推理。它面向原生 C++ 应用,省去针对具体模型的转换、预处理、后处理与运行时代码编写。
Hugging Face 与 Voice Arena 合作,在 Open ASR Leaderboard 引入 Monsoon en-IN 和 Monsoon hi-IN 两套评测集,其中印地语是该多语言榜单首个印度语言。
Midjourney 开始让所有用户测试首个 V8.2 图像编辑模型。该模型支持用指令编辑图像、以最多 4 张图像参考生成新图(替代 omni-reference)、局部重绘(inpainting)与扩图(outpainting),并可用 personalization、moodboards 和 srefs。
推荐理由:官方宣布 V8.2 图像编辑模型开放测试,列出指令编辑、多图参考、局部重绘等能力变化和具体入口。
Google DeepMind 推出全球首个针对专有前沿模型的双盲评估,将外部评估限制在密码学安全的"盒子"中,防止模型提前接触测试题导致基准污染。此次与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境中用机密基准测试一个 Gemini Flash Lite 模型。
Google DeepMind 发布 Gemini 3.5 Transcribe,称其为目前最精确的语音转文字模型,可将原始音频直接转为整洁、带格式的文本。
推荐理由:原文来自官方发布,给出了 WER 数据、双 API 接入方式和开放入口,读者可以据此评估语音转写工作流是否值得迁移。
NVIDIA Dynamo 预览版新增影子引擎恢复功能,可在 LLM 引擎进程故障后数秒内恢复推理容量,替代需从存储加载权重到 HBM、编译 kernel 并捕获 NVIDIA CUDA graphs 的冷启动路径。大模型冷启动初始化通常耗时数分钟,期间存活 worker 需承接转移流量。
NVIDIA 技术博客宣布 CUDA Python 1.0,主打稳定 API、统一基础和对完整平台的访问。文章指出此前 Python 开发者要用 GPU 只有两条现实路径:学 CUDA C++ 写扩展并维护 Python 绑定,或依赖 PyTorch、CuPy、RAPIDS 等上层库,而后者虽有局限却推动了 Python GPU 生态的繁荣。
Nous Research 为 Hermes Agent 推出 Sprites 终端后端插件,基于 Fly.io 云沙箱提供有状态运行环境,支持 checkpoint 与 restore。该插件已在 GitHub 开源。
Meta 在工程博客发布自研训练芯片 MTIA 300,这是 MTIA 家族中首款针对推荐与排序模型训练优化的加速器。
NVIDIA Groq 3 LPX 是 NVIDIA Vera Rubin 平台的交互式 AI 推理加速器,与 Vera Rubin NVL72 搭配可扩展该平台的长上下文交互能力。Vera Rubin NVL72 面向从小型到大型、开源与闭源的最广泛 AI 工作负载,兼顾高吞吐与交互性。
NVIDIA 发文阐述用 Vera CPU 应对智能体 AI 集群挑战:GPU 负责运行模型,CPU 承担编排、工具执行与沙箱计算。文章指出,与传统负载稳定的运行特征不同,智能体工作负载不可预测且波动极大,AI 工厂的集群经济性取决于整个技术栈将电力与资本转化为已完成智能体任务的效率。
Midjourney 为 alpha.midjourney.com 上线两周的大改版推送了一批 UX 改进与 bug 修复,侧边栏新增可折叠的文件夹树分组,支持双击重命名分组并把新文件夹直接归入其中。
NVIDIA 的 AVO 在 ARC-AGI-3 上取得 100% 成绩,展示了一种面向长时程自主智能体的前沿级通用架构。该工作指出前沿语言模型只是 AI 智能体的一部分,真正决定模型如何接收上下文、使用工具、维持状态、响应反馈、从失败中恢复并在长任务中持续推进的,是外围的智能体系统(常称为 harness)。