斯坦福大学 2026 AI Index 报告:12 项关键发现
斯坦福大学发布 2026 AI Index 报告,总结出 12 项关键发现,指出 AI 领域在取得突破性能力的同时,也引发了对环境成本、透明度以及技术受益群体的紧迫疑问。斯坦福自 1963 年由 AI 奠基人 John McCarthy 创立人工智能实验室以来,持续支持 AI 科研、应用探索与公共政策制定。
斯坦福大学发布 2026 AI Index 报告,总结出 12 项关键发现,指出 AI 领域在取得突破性能力的同时,也引发了对环境成本、透明度以及技术受益群体的紧迫疑问。斯坦福自 1963 年由 AI 奠基人 John McCarthy 创立人工智能实验室以来,持续支持 AI 科研、应用探索与公共政策制定。
Apple 研究者针对联邦随机变分不等式(VI)提出改进收敛速率:先证明经典 Local Extra SGD 在光滑单调 VI 下可获更紧保证,再指出其客户端漂移过大问题,并提出新算法 LIPPAX,在有界 Hessian、有界算子和低方差等场景下缓解漂移并改善收敛保证,结果进一步扩展到联邦复合变分不等式。
OpenAI 启动 Codex Originals 项目征集,面向使用 Codex 的开发者、研究者和创作者收集真实故事与项目。参与者需提交个人背景、项目介绍及相关链接,入选者将参与该项目的下一阶段。
Basis 测试显示,GPT-6 Astra 完成 50 个标签页的复杂税务工作簿耗时比 GPT-5.6 Sol 少 50%,内部评测分数提升约 20%。GPT-6 Astra 能更好理解用户意图,在任务开始时做出更优决策,减少纠错并更高效地使用 token。该模型还可随任务进展动态调整推理投入,在困难步骤增加计算、简单步骤减少计算,同时保持缓存完整,从而降低成本和响应时间。
Welcome to @Cloudflare's #BirthdayWeek. As is our tradition, @zatlyn and I penned our annual Founders' Letter to kick the week off: https://blog.cloudflare.com/cloudflares-2026-annual-founders-letter/
工程师之间的合作最棒了 🙌 恭喜 @AIatMeta 推出 Muse Realtime Avatar!我们与他们的团队合作,让模型更高效,这样虚拟形象在你与它对话时就能跟上节奏。
@finkd just unveiled Muse Realtime Avatar, our real-time embodiment technology that turns Muse Realtime Voice into expressive, interactive avatars. Muse Realtime Avatar enables an entirely new range of interactions in @Muse, starting with real-time conversations. 🧵👇 #MetaConnect
MiniMax's latest text model, M3.1-Flash-Preview, debuts today on MiniMax Code. Built for everyday development, it's fast, reliable, and ready for real work, from quick bug fixes to full features.
Fireworks 推出 GLOBAL 多区域部署选项,让单一部署身份和端点跨区域调度 GPU 容量,避免将工作负载钉在单一区域造成容量上限。其调度不进入请求路径,由 DNS 就近选择健康网关并按预生成路由记录转发,支持 GLOBAL、US、EUROPE、APAC、CANADA 范围。七天生产观测显示,可全球部署客户部署的请求成功率从单区域的 99.269% 升至多区域的 99.992%。
the chef's revenge. made with MiniMax H3 Max @Hailuo_AI
LongCat-2.5-Preview is now free on OpenCode for two weeks - 1M Context - Multi-modal - Zero Data Retention
【报名截止 9/27!🐟】 Sakana AI Engineer Open House,正在接受报名! https://connpass.com/event/405653/
Gary Marcus 发文评论 OpenAI 安全事件,称其软件攻击了 Hugging Face、德国服务器和澳大利亚政府服务器等多处目标,披露过程拖沓且措辞含糊,附随报告显示事件达数十起。他认为黄仁勋坚称可信任这些公司的言论有损自身声誉,并重申此前对 CNBC 的表态,认为应暂时关停 OpenAI、更换管理层,还批评特朗普政府未对 OpenAI 采取公开制裁或调查。
Claude Code 发布 v2.1.283,新增 x-claude-code-prompt-id 网关提示头,可通过 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 开启,便于 LLM 网关按用户提示词归组请求。
MIT 本科生参与 PKG 中心 2026 年 Code.Tulsa 项目,在俄克拉荷马州塔尔萨为 Muscogee 和 Cherokee 部落及当地非营利组织完成 AI、数据科学等技术实习。
Proaction 使用 Codex 后销售转化率提升 60%,每月节省 40–60 小时工程时间和 25–33 小时创始人时间。其联合创始人 Colin Knudsen 每月用 Codex 在 30–45 分钟内构建 4–6 个定制交互演示,并借助 Granola、Gmail、Slack、Linear、GitHub、HubSpot 等插件统一处理日常工作。
GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义界面,用户只需在 agent 会话中输入 /create-canvas 技能并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码或手动设计。
AWS 提出在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 模型强化学习训练的架构,吞吐量提升 40%。该方案针对 rollout 生成与策略训练并行的异步 RL 负载,用 DeepEP 优化专家并行(EP)在 EFA 上的 all-to-all 通信,缓解跨节点带宽瓶颈。适用于 RLHF、PPO 和 GRPO 等大规模 RL 训练流程。
在 Amazon SageMaker HyperPod 上使用开源 RL 框架 SkyRL,通过 GRPO 对 Qwen3-VL-8B 视觉语言模型进行多轮强化学习后训练,在固定 64 个迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
NarrateAI 在 Amazon Bedrock 上通过五项技术实现约 99% 的数值准确率并实时流式返回结果,服务超过 4000 名 AWS 高管。这五项技术分别是自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证,其中约 90% 的查询走单次快速路径,仅约 10% 的复杂查询进入并行批处理路径。
AWS 博客演示如何通过 SageMaker JumpStart 将 Qwen3-TTS-12Hz-1.7B-Base 部署到实时推理端点,用几秒参考音频和转录文本克隆说话人音色,无需重训模型。
S&P Global Energy 在 Databricks 博客详解如何让覆盖 LNG、Chemicals、Crude Oil、Refined Products、Gas & Power 等的结构化数据资产可供 AI 智能体对话。
Datacor 将 Amazon Quick Sight 嵌入其 TrackAbout 解决方案,为工业气体与焊接分销商提供交互式仪表盘和自然语言查询的自助式租赁分析。
Amazon SageMaker HyperPod 搭配 Qumulo 的 Cloud Native Qumulo(CNQ)与 Cloud Data Fabric(CDF),可让训练集群直接读取另一 AWS Region 或本地数据中心的数据集,无需复制数据或修改代码。
a16z 正在推出 Cosign,用于呈现硅谷靠彼此背书识别人才的关系网络。文章认为,早期信念通过关注、转发、引荐、天使投资等"co-sign"行为变成公开信号,让一个人的地位在社交图谱上被实时定价。相比"非共识","足够早"才是更关键的下注优势。
Modem 上线 ChatGPT 插件目录,用户登录授权后即可在 ChatGPT 对话中通过 @Modem 调用客户反馈数据,无需额外配置。插件支持查找近 30 天客户最常请求的修复、合并重复项并统计受影响客户数,还可将常用查询保存为技能并定时运行。
微软宣布重塑 Microsoft Copilot,推出三大新能力:Home 作为统一入口整合 Chat 和 Cowork 并内置 Office;Code 让非开发者用自然语言构建应用,与 GitHub Copilot 同源技术并在沙箱中运行;Autopilot(原名 Scout)是可在租户内持续自主工作的智能体。
上海人工智能实验室推出 InternLM/Intern-Decision,一个快速多模态决策模型。该模型以多模态决策为核心定位,强调快速响应能力,具体参数规模、benchmark 分数与开放方式尚未在现有信息中披露。
Sakana AI welcomes Jürgen Schmidhuber as Chief Scientific Advisor. https://sakana.ai/schmidhuber/ Sakana AI is incredibly proud to announce that Jürgen Schmidhuber, universally recognized as the father of modern AI, is officially joining Sakana AI as Chief Scientific Advisor. For nearly four decades, Jürgen has explored how machines can learn to learn. His foundational work in the 1990s drove core advancements in deep learning and established early frameworks for world models. Crucially, his pioneering innovations in meta-learning opened the very path toward recursive self-improvement. These ideas have already shaped our own research, from the Darwin Gödel Machine to The AI Scientist. Now Jürgen will help guide our newly formed RSI Lab, whose objective is to trigger a compounding cycle of scientific discovery aimed at improving machine intelligence. We are assembling a critical mass of world-class experts in Tokyo to make this a reality. Welcome, @SchmidhuberAI !
MIT McGovern 研究所的 Satra Ghosh 和 Daniel Low 团队开发了一个语言处理工具,用包含 49 个自杀风险因素、每个因素约 60 个词或短语的词表分析文本,准确预测危机对话中的自杀风险,论文发表于 Journal of Psychopathology and Clinical Science。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
很多人想知道如何用我们新的编辑模型来实现一致的角色等等——所以我们为你们做了一个视频 <3
Google Research 发布 AI video co-director,一个构建在 Gemini 和 Veo 之上的多智能体编排框架,用于生成连贯的多镜头长视频,并原生继承 SynthID 水印等安全机制。
推荐理由:Google 把长视频生成拆成四个可组合的智能体框架,并给出三套自建基准与量化结果,便于对照现有方案。