a16z 投资 Gimlet Labs:打造首个多芯片推理云
a16z 宣布投资 Gimlet Labs,后者正在构建首个多芯片推理云,可在同一功耗范围内为前沿模型带来最高 10 倍吞吐与交互性提升。Gimlet 通过编译器与运行时把不同模型和工具调度到 GPU、CPU 及专用加速器上,并将编排延伸至数据中心层面,对开发者只暴露单一推理 API。其客户已包括一家前沿实验室和一家超大规模云厂商。
a16z 宣布投资 Gimlet Labs,后者正在构建首个多芯片推理云,可在同一功耗范围内为前沿模型带来最高 10 倍吞吐与交互性提升。Gimlet 通过编译器与运行时把不同模型和工具调度到 GPU、CPU 及专用加速器上,并将编排延伸至数据中心层面,对开发者只暴露单一推理 API。其客户已包括一家前沿实验室和一家超大规模云厂商。
Midjourney 正在征集用户反馈和改进想法,以确定下一步优先开发的方向,用户可通过 midjourney.com/ideas 提交建议。官方表示将在接下来一两周内举行正式投票。
对于今早孟菲斯计算中心宕机后您可能在使用 Grok 时遇到的问题,我们深表歉意。我们也要向受影响的计算合作伙伴致歉。 目前所有系统均已恢复,运行正常。
Gergely Orosz 在 The Pulse 中指出 Uber、Pinterest、Stripe、Coinbase、Ramp、AT&T 等公司正弃用专有模型并采用智能模型路由来节省 AI 开支,Ramp 数据显示 8 月头部 1% 企业 AI 支出下降 10%。
风投正押注 AI 智能体将重塑电商与支付市场,当前资金多流向基础设施与工具层。Adobe Analytics 调查显示,6 月有 41% 受访者用 AI 网购,53% 购物者信任 AI 推荐的程度不亚于品牌官网。
推荐理由:作者亲述收购立场,并给出官方博客链接,读者可借此了解其对开放模型生态价值的判断。
MIT 城市研究与规划系及 Sloan 管理学院高级讲师 Walter Torous 被任命为 MIT 房地产中心(CRE)执行主任,2026 年 7 月 1 日起生效,他将继续兼任 MSRED 项目主任。
SemiAnalysis 深度分析韩国主权 AI 战略:政府以锦标赛制推进“独立 AI 基础模型”项目,从 15 个联合体中选出 Naver Cloud、LG AI Research、SK Telecom、NC AI、Upstage 五队,首轮后淘汰 NC AI 并因使用阿里 Qwen 视觉与音频编码器取消 Naver 资格,递补 Motif Technologies。
Sierra 宣布 Julia Brau Donnelly 出任首席财务官,她此前曾任 Pinterest CFO,并拥有投资银行、私募投资及 Wayfair 运营经验。Sierra 上线两年半已成为面向客户的对话式 AI 平台,七个季度达到 $100M ARR,九个季度达到 $200M ARR,客户覆盖超 40% 的 Fortune 50。
MIT 研究项目 Julia 已发展为拥有超 100 万用户的免费开源编程语言,被全球数千家公司和大学用于科学计算与复杂系统建模。Julia 依靠即时编译(just-in-time compilation)兼顾易用性与高性能,其联合创始团队还创办了 JuliaHub,并于 4 月推出 AI 平台 Dyad 3.0,帮助工程团队以智能体方式加速火箭、热泵、卫星等物理系统设计。
IBM 在 Hot Chips 2026 首场演讲中披露下一代 z/Architecture(z18)设计,该核心同时支持 z/Architecture 与 Arm 两套指令集,采用共享解码流水线加独立解码器的方案。
XCENA 与三星合作推出 CXL 内存扩展设备 MX1,可支持最高 2 TB DDR5 内存,通过 PCIe 6/CXL 3.2 x8 接口提供 128 GB/s 主机带宽,并额外提供 8 条下游 PCIe 6 通道连接 SSD。
三星在 Hot Chips 2026 上介绍了其 LPDDR5X-PIM 方案,在 16 个 bank 中各放置一个 PIM 块,通过 MAC 阵列利用芯片内部带宽,合计可达 614 GB/s,而常规 DRAM 访问最高仅 76.8 GB/s。
推荐理由:Cursor CEO 回应 OpenAI 计划限制访问,补充了自家流量占比和沟通进展等一手信息。
Nvidia 上季度营收 960 亿美元、净赚 540 亿美元,CEO 黄仁勋预计明年营收增长 70%,并以 60 亿美元获得 Poolside 大部分团队、约 129 亿美元收购 Hugging Face,还考虑以 300 亿美元估值投资 Perplexity。
企业级个人助理初创公司 Town 正洽谈由 Index Ventures 领投的新一轮融资,估值达 10 亿美元,此前已获 Andreessen Horowitz 和 Forerunner 投资。
Gergely Orosz 的 The Pulse 专栏讨论 Meta 是否真因 AI 决定将团队规模缩减 60%。据路透社深度报道,Meta 领导层自 1 月起筹划这一 Social 巨头史上最大规模裁员。
Google DeepMind 推出全球首个针对专有前沿模型的双盲评估,将外部评估限制在密码学安全的"盒子"中,防止模型提前接触测试题导致基准污染。此次与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境中用机密基准测试一个 Gemini Flash Lite 模型。
Kengo 夺冠了!🏆 星海图的双足人形机器人在 WORLD HUMANOID ROBOT GAMES(2026)自由体操比赛中夺得第一名。 为运动而生——并准备好走得更远。
Intel 在 Hot Chips 上披露了数据中心 GPU Crescent Island 的细节,其 LPDDR5X 内存子系统最高支持 480 GB DRAM,为目前所有 GPU/AI 加速器中容量最高,可单卡直接运行 DeepSeek-V4 Flash。
NVIDIA 通过 NVLink Fusion 将 NVHBM 引入下一代 AI 基础设施,面向超大规模厂商和 AI 原生公司自研的 XPU 加速器。随着模型规模与推理负载增长,XPU 规模化部署需要高带宽内存(HBM)持续供给算力,并需要足够的封装与硅片面积容纳更多计算单元。
下一代机器人技术需要能够在虚拟世界和物理世界中理解、模拟、学习和行动的模型。 我们正在招聘一位高级业务拓展负责人,方向为机器人与物理 AI,帮助将这项技术带入现实世界应用 🤖🚀
Ramp 自研了内部后台 coding agent Inspect,目前 75% 的已合并 PR 由 Inspect 发起,7 月总 session 数突破 100 万。
SemiAnalysis 受邀在实验室实测 OpenAI 与 Broadcom 合作、为 LLM 推理从零设计的 Jalapeño 芯片,称其在 DeepSeek R1、Kimi K2.5、GPT-OSS 等模型上的 perf/W 超越其测过的所有 Nvidia、AMD、Google 芯片。
Sierra 宣布在首尔开设办公室,将其客户服务 AI 平台带入韩国市场。该平台已与全球三分之一领先银行及 40% 的 Fortune 50 企业合作,按结果而非使用量收费。其 Horizon 智能体可跨系统长期运行,Singtel 10 周上线后解决率超 70%,Next 6 周上线覆盖 48 种语言、83 个国家,BBVA 30 天内部署首个 Horizon 智能体。
Intel 在 Hot Chips 2026 介绍了 Wildcat Lake(Core Series 3),面向低成本移动平台,采用 MCP 封装而非先进封装,并改用独立平台以降低整体 BOM 成本。
Meta 发布 MetaRoCE,一个为 AI 工作负载在商品化以太网上从零设计的 RDMA 传输协议,将通过 OCP 开放规范、参考软件实现和合规测试套件。
Meta 在工程博客发布自研训练芯片 MTIA 300,这是 MTIA 家族中首款针对推荐与排序模型训练优化的加速器。
Nvidia 在 Hot Chips 2026 上介绍将 CUDA 扩展到 RISC-V CPU 的要求,包括 RVA23 Profile、RISC-V 服务器 SoC 与平台规范、ACPI、PCIe 一致性和点对点 PCIe 通信等,并与 SiFive 合作演示运行 CUDA 的服务器系统。作者指出绝大多数现有 RISC-V 硬件尚不满足要求,近期支持可能仅限于服务器级系统。
Mistral 与 HUMAIN 宣布在 AI 基础设施、先进模型开发和 AI 解决方案部署上展开战略合作,聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型。合作规模达数亿欧元,Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还将在沙特面向受监管行业制定联合市场策略。
生成式 AI 推动分布式模型训练扩展至数十万块 GPU,节点间的 scale-out 网络已成为首要性能瓶颈。NVIDIA 在技术博客中解析 Spectrum-X Ethernet 如何针对这一瓶颈改写传统以太网的规则。
NVIDIA 称 Vera Rubin 与 Blackwell 为智能体 AI 的每瓦性能树立新标准。OpenRouter 的 State of AI 报告基于 100 万亿 token 的真实使用数据发现,平均每请求提示词 token 数增长约四倍,反映 AI 智能体已从单轮交互扩展到多步工作流。
NVIDIA BlueField-4 为智能体 AI 工厂提供新型 Scale-In 网络基础设施,面向每服务器多太比特带宽的加速计算场景。传统云基础设施面向可预测的通用工作负载和标准接口,而智能体 AI 工厂需连接多样用户、智能体、应用、数据源与存储系统,因此专用 DPU 处理对线速网络、存储和安全至关重要。
Hot Chips 2026 教程日上,Anurag Agarwal 与 Radhakrishna Giduthuri 探讨了 High Bandwidth Flash(HBF)在机器学习负载中的应用,由于尚无 HBF 产品,演讲基于模拟与预测。
三星在 Hot Chips 2026 上介绍了 HBM Base Die 的三阶段演进方案,HBM4 与 HBM4E 的 base die 已改用 4nm 逻辑工艺以抑制功耗上升。
感谢我们的全球合作伙伴,在北京 WRC 2026 共度了一个美妙的夜晚。精彩的对话、大胆的想法,以及对具身智能的共同愿景。下次见!#EmbodiedAI #WRC2026 #Galaxea
GLM-5.3 × ZCode Weekend Build, Round 2 🚀 New users: log in to ZCode for the first time from Aug 22, 00:00 to Aug 24, 09:00 (UTC+8) and automatically get 100M free GLM-5.3 tokens. 50,000 packs, first come, first served; ZCode only. Unused tokens expire when the event ends. Grab yours: http://zcode.z.ai
SpaceX 本周以600亿美元股票收购 Cursor,为风投支持的创业公司史上最大规模买断;Stripe 同意以约80亿美元收购 OpenRouter。a16z 在两家公司合计投入约3.2亿美元,账面回报超过80亿美元,其由 Martin Casado 主导的基建投资团队操盘了两笔交易。
推荐理由:原文梳理了两笔巨额退出与 a16z 基建投资操盘细节,读者可以借此理解 megafund 模式如何兑现回报。